「研究与产品」共找到 8053 篇相关文章
DeepSeek在Agent上做了件大事!
昨天DeepSeek发布V3.2正式版,强化Agent能力并融入思考推理,其在Agent评测达开源模型最高水平。文中分析Agent成开源‘心病’的痛点,介绍DeepSeek相关解决策略及成果,还给出使用示例。
全面战胜ReAct!斯坦福全新智能体推理框架,性能提升112.5%
斯坦福和MIT团队推出新AI智能体推理框架ReCAP,在长上下文任务中全面超越ReAct,性能提升显著。它通过独特结构和三大机制解决大模型常见问题,虽成本增加,但在关键任务表现出色,潜力巨大。
吴恩达发布论文自动审阅器,ICLR上达到接近人类水平
目前学术会议论文评审无统一规范,投稿量膨胀致审稿周期冗长。吴恩达发布‘Agentic Reviewer’,在ICLR 2025数据测试中接近人类水平,现阶段在arXiv研究领域表现佳,但仍处实验阶段。
Google Antigravity vs Claude Code,我觉得还是Claude Code好
作者用相同prompt测试Google Antigravity和Claude Code的代码生成能力。Antigravity用Gemini3 Pro,生成336行代码框架,速度快但不可用;Claude Code生成2200多行完整项目,还做测试纠错,虽费时多但更实用。
这款开源AI卡片笔记,让我果断卸载了Obsidian!
开源君推荐开源项目Blinko,它是自托管、AI驱动的个人笔记工具,主打“快”与“智能”,将RAG技术和LLM能力融入笔记管理,数据自主可控,适合注重数据安全和知识管理的人。
刚刚,Yann LeCun官宣离职创业,瞄准高级机器智能AMI
图灵奖得主Yann LeCun宣布离职Meta创业,新公司聚焦高级机器智能(AMI),继续其“世界模型”研究。他是LLM批评者,认为其无法理解物理世界,新公司目标推动AI重大革命。
ChatGPT「群聊」功能正式开启内测
OpenAI正式在部分地区试点ChatGPT群聊,覆盖移动端和网页端。该功能可用于生活娱乐、工作学习等场景,由GPT - 5.1 Auto模型驱动,操作简单,还考虑了隐私与控制。
火了!刚刚,李飞飞2篇最新文章发布!
AI圈近期被李飞飞两篇重磅文章刷屏,一篇阐述空间智能愿景,指出当前AI缺乏空间智能,其创办的World Labs提出世界模型;另一篇论文揭示当前视频理解基准自欺欺人,还提出新基准VSI - SUPER及预测性感知新范式。
Meta提出数据筛选的理论:何时“少即是多”成立?
Meta针对机器学习领域‘少即是多’悖论提出理论框架,用高维统计等方法推导测试误差缩放定律,揭示数据筛选‘相变’条件,为实践提供指导,还重新定义‘数据效率’意义。
一次性应用出现,个人独角兽崛起:顶级布道师Jeff Barr论AI如何重塑开发者生态|InfoQ独家采访Jeff Barr
InfoQ 独家采访亚马逊云科技核心奠基人 Jeff Barr,探讨 AI 对开发者生态的变革。他认为 AI 是能力放大器,将催生一次性应用和个人独角兽,开发者角色转变,沟通和数据更重要,还介绍了应对建议及 Kiro 挑战活动。