速度和准确性」共找到 7285 篇相关文章

算法论文8

NIPS2025 | A-Mem让Agent拥有动态自我记忆功能,达到新SoTA

近年来,LLM代理需长期内存系统,但现有系统缺乏灵活性。论文提出A - Mem能动内存系统,受Zettelkasten启发,能让记忆‘自我整理’‘自我更新’,在多基准测试领先,也指出了局限性未来方向。

深度学习自然语言处理
开源动态8

15个前沿大模型,100个职业场景:谁才是最强AI打工人?

通义千问与港中文联合发布OccuBench,用语言世界模型评测AI Agent职业能力。评测15个前沿模型,发现无全能选手,隐式故障难处理,Scaling定律有效,做Agent环境模拟器能力不同,还给出具体案例。

AI科技评论
算法论文8

人大高瓴孙浩团队发表Nature子刊封面文章:基于并行符号枚举的物理定律发现

中国人民大学高瓴人工智能学院孙浩教授团队在《自然 - 计算科学》发表封面论文。提出PSE框架解决符号回归瓶颈,通过公共子树复用GPU并行提升评估效率,实验表现优于现有方法,也指出了局限性与未来方向。

力学与人工智能
新闻资讯7

OpenAI CFO 摊牌:算力即营收,而 90% 的企业正被卷死在“能力鸿沟”里

本期 OpenAI 播客嘉宾,CFO Sarah Friar 投资人 Vinod Khosla 探讨 AI 应用。指出多数人使用 AI 能力有限,2026 年是弥合“能力鸿沟”开端。还提及算力与营收相关,OpenAI 在企业端已领先,创业公司也有机会。

AI科技大本营
产品应用7

AI驱动前端重构:10天完成3000+行复杂组件的跨端复用实践

本文分享阿里团队实践,用AI开发工具Cursor结合Claude模型,10天重构超3000行前端组件实现跨端复用。介绍代码辅助、测试用例生产、代码智能生产经验,提出新开发范式,强调规范人工校验重要性。

阿里云开发者
产品应用8

OpenAI 发布新的 Codex 桌面版,我现在不骂 Codex 难用了

OpenAI发布Codex Desktop App,是macOS桌面应用。它有图形界面,支持定时任务、Skills管理多Agent并行运行。还对比了与Claude Code的差别,介绍了OpenClaw项目,最后说明不同用户的使用场景用量定价。

宝玉AI
新闻资讯7

前端没死,AI APP正在返祖

蚂蚁集团翁欣旦在SEE Conf大会提出,前端未被AI杀死,复杂度只是换形式存在。AI APP有交互架构的返祖现象,终端因网络算力限制不可替代,程序员应利用工程经验把握AI应用机会。

量子位
新闻资讯7

OpenAI诈骗?GPT-4.1正式上线ChatGPT,网友实测却大呼失望

OpenAI官宣GPT - 4.1在ChatGPT中可用,Plus、ProTeam用户可访问。它擅长编码遵循指令,评估表现有优有劣。实测代码处理表现佳,但网友因无100万上下文窗口API版本而失望。

新智元
算法论文8

ACL 2026 | 中科大&上海AILab揭示强化学习后训练的Scaling Law

中国科学技术大学上海人工智能实验室等团队,在Qwen2.5Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。

机器之心
新闻资讯8

OpenAI最新开发者“全家桶”:Apps SDK、Agent Builder、ChatKit深度解读与实测

长假期间,OpenAI在2025 DevDay宣布开发者生态重大升级,引入“Apps in ChatGPT”及其SDKAgentKit工具集。文章深度解读Apps SDK、Agent Builder、ChatKit,介绍功能、使用方法体验,还提及OpenAI的AI大平台战略。

AI大模型应用实践