「自主科研Agent」共找到 3339 篇相关文章
Anthropic 今天发了一个新产品,可能会让一批做 AI 智能体基础设施的团队失业
Anthropic 发布新产品 Claude Managed Agents,基础设施全包按用量收费。其年经常性收入破 300 亿美元。该产品与 Claude Code 有别,能解决企业痛点,已有不少企业使用,也存在局限性。
用人类脑电波教 AI 开车,这位清华 90 后学者直言隐式信号里藏着 AGI 的关键 | 万有引力
清华大学龚江涛团队用人类驾驶员脑电波教会自动驾驶模型“思考”,成果E³AD发表于NeurIPS 2025。龚江涛从计算机转向人机交互,在多段科研经历中积累经验,探索将人类“直觉”赋予AI。
OPPO AI重磅发布:深度研究智能体,离“真正好用”还有多远?我们给大模型做了一次全身体检
2025年,Deep Research成AI热点,OPPO AI Agent Team对大模型评测。发布论文,开源评测基准FINDER和失败分类体系DEFT,揭示AI“装懂”“缺乏韧性”问题,还分析模型表现并给出发展建议。
奥特曼下注27岁神秘青年,「复活」世界最顶级实验室
27岁的路易斯·安德烈获奥特曼、孙正义等投资,成立Episteme公司,欲打造现代版贝尔实验室。该公司旨在支持科研者,让其摆脱压力专注研究,虽面临诸多挑战,但也有成功可能。
DeepSeek最会讨好,LLM太懂人情世故了,超人类50%
研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。
他们从四家顶尖AI实验室辞职,打造能自己跑实验的AI系统,目标是让科学家实现Vibe Research
2026年初,Harsh Mehta和Behnam Neyshabur离开Anthropic,在旧金山注册Mirendil,6月25日公司亮相并完成2亿美元种子轮融资。团队来自四家顶尖机构,目标是构建自主处理AI研发问题的系统,降低AI研发门槛。
姚顺宇谷歌首秀,Gemini新模型刷爆SOTA:人类仅剩7人捍卫碳基编程
面对Claude Opus 4.6和GPT Codex 5.3的攻势,谷歌升级Gemini 3 Deep Think,在多项基准测试刷爆SOTA,推理成本降低82%。它还走进科研工程领域,其研发团队有不少华人,如姚顺宇、Yi Tay。
直接免单!阿里千问30亿请客吃喝玩乐,春节AI大战彻底白热化
阿里千问APP官宣砸30亿开启「春节请客计划」,2月6日起以「免单」请全国人民吃喝玩乐,阿里生态「全家桶」加入。千问已接入阿里生态,借补贴加速AI Agent普及,有望凭「免单+服务」成「生活万事通」。
数学奥赛高分摘金,位列大模型榜首,『书生』科学多模态大模型Intern-S1能力再升级 | 通专融合新进展
2025年CMO决赛首设AI测试,书生科学多模态大模型Intern-S1以102分位列大模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研。
奥特曼:假如给我一千倍算力,我会这样做
奥特曼在最新访谈展望下一代模型,认为完美AI是有超人推理能力等的微型模型。理想AGI能自主发现新科学,使全球科学发现提速。他还回应算力假设,为企业指明投入资源方向。