「AI自主性」共找到 10124 篇相关文章

新闻资讯8

博士80小时熬夜改代码,Codex 2小时交卷!科研奇点来了

近日,Agentic AI工程师Dan McAteer实验发现,OpenAI Codex的Goal Mode完成机械可解释性研究任务,效率比博士高40倍。Codex /goal模式能自主循环,契合科研流程。此外,递归自我改进证据涌现,AGI或早已实现。

新智元
新闻资讯7

Meta发布40页报告,具身智能的下一步是「心智世界模型」:能听,能看,能理解,会共情

Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智能体协作潜力大。

量子位
开源动态8

o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界

GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。

AI科技评论
新闻资讯8

百度:和大家一起讲 「超级有用」的故事

作者参加百度AI DAY智能云创新行业专场,看到百度全栈AI解决方案矩阵及应用案例。百度通过构建生态、全栈自研、推动科技平权等举措发力AI,诸多应用已取得商业成果,有望在AI商业化长跑中胜出。

MacTalk
开源动态8

让LLM不再话痨,快手HiPO框架来了

当前LLM存在‘过度思考’困境,效率与成本矛盾突出。快手与南大合作推出HiPO框架,通过混合数据冷启动和混合强化学习奖励系统,让模型能自主决策思考模式,实验显示它提升了效率和准确率,还具强泛化性。

机器之心
产品应用7

GPT5.5 + Codex 如何跑一整夜,编程的下一步,不是辅助编程,是可托管执行单元

文章指出GPT - 5.5在Codex里展现出强大自主性,能处理长时程任务。还介绍让其跑长任务的方法及面临的问题,强调长任务需状态机、证据链等,社区也在构建相关工作流层。

AI进修生
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI
新闻资讯7

Sam Altman:我嫉妒死现在的年轻人了!

当下年轻人面临裁员、内卷,奥特曼却称他们是最幸运一代,引发争议。文章指出过去靠努力升职加薪的逻辑在AI时代失效,流程性岗位被自动化接管,权力从大厂下放个人,还提醒要适应新变化。

新智元
算法论文8

AAAI 2026 Oral:明略科技开创稀疏数据「信息瓶颈动态压缩」,精度+速度双SOTA

在机器人和具身智能领域,transformer模型又大又‘重’,边缘设备难以承受。东南大学、中南大学、明略科技联合提出的CompTrack论文,创新性解决AI模型处理稀疏数据的‘双重冗余’,在3D点云跟踪任务上实现精度和速度双优。

机器之心
新闻资讯7

苹果密谋300亿美元天价收购Perplexity,小扎狂挖印度裔CEO!

AI战火正旺,苹果考虑收购估值140亿美元的AI初创公司Perplexity,这或成其史上最大规模收购。Perplexity有实时联网的AI搜索引擎等,苹果有三种合作设想,但三星或抢先合作。此外,Meta曾想收购Perplexity,后投资Scale AI。

新智元