「模型性能提升」共找到 9416 篇相关文章
深度拆解 Gemini 3.8 Live:一句插话,为什么会牵动整个 Agent 系统
本文深度拆解Google发布的Gemini 3.8 Live,分析其将语音、推理、工具调用整合进持续运行链路的架构创新,探讨Voice Agent进入Runtime阶段的核心技术挑战与未来AI Agent发展趋势。
NVIDIA 李柏依:机器人只会「看」还不够,它还得学会「听」| ECCV 2026
本文整理了NVIDIA Research科学家李柏依在ECCV 2026 Workshop的分享,针对机器人训练数据采集壁垒高的问题,介绍了两项解决多模态感知与灵巧操作数据难题的前沿研究。
更省 Token 的国产 Codex:ZCode,加上 DeepSeek 更夯!
介绍国产 Codex 平替 ZCode,它有 100 万用户,能接 DeepSeek,模型选择开放,缓存命中率高省 Token,插件生态完善,还介绍了安装、接入方法及多种实用功能。
读博最后一年转方向,拿到OpenAI offer:我的面试之路充满「意外」
布朗大学博士生Yong Zheng - Xin自宣下月加入OpenAI做AI安全研究。他博士最后一年转方向,分享求职经历,总结6个意外洞察,如求职重要的可能仅一两篇论文、面试形式多样等。
NVIDIA团队让编程Agent接管真实机器人实验,成功率达99%
NVIDIA GEAR 实验室负责人介绍 ENPIRE 项目,首次在机器人硬件实现自动化研究。让 8 个 Codex Agent 驱动闭环,完成高精度任务,成功率 99%。项目计划开源,还提出 MRU 与 MTU 指标。
突发!卡帕西宣布入职Anthropic
大神Karpathy宣布加入Anthropic,重回一线大厂。他曾多次在AI领域转换角色,此次将加入预训练团队,开展用Claude加速自身预训练研究。外界揣测其离开OpenAI原因,加入Anthropic能为研究提供更多资源。
OpenClaw带火AI记忆,DeepMind用混合记忆把3D重建拉到近2万帧
近期,全球爆火的 Agent 私人助手 OpenClaw 接连更新,其长期记忆能力获关注。谷歌 DeepMind 联合加州大学伯克利分校提出 LoGeR 架构,将 3D 重建扩展到极长序列,在多数据集上表现超越先前方法。
OpenAI发布Symphony:AI时代的敏捷看板
OpenAI在GitHub发布Symphony项目,处于工程预览阶段。其核心理念是将项目工作转化为自主运行,通过看板管理工作流程。几乎同时,Paperclip项目宣布开源,提供完整企业架构。二者标志AI辅助开发向流程层面转变。
这个一年前出现的词让小白从 0 到月入 1 万美金成为现实
一年前,Andrej Karpathy 提出“Vibe Coding”,用户通过 AI 用自然语言提示生成代码,开发更快、构建更易,让小白也能写代码。如今它成现象级术语,未来还会持续发展。
Cursor AI 上下文管理的秘诀
Cursor发表《Dynamic context discovery》文章,讲述上下文管理秘密,提出“动态上下文发现”模式,分享五个优化手段,如长输出变文件、聊天历史变档案等,还阐述了为何用“文件”及相关思考。