智能体推理」共找到 5152 篇相关文章

新闻资讯7

刚刚,人类社交网络巨头Meta收购了AI社交网络Moltbook

Meta收购AI社交网络Moltbook,将其两位核心创作者招致麾下。Moltbook虽被指是‘赛博过家家’,但其建立的智能验证身份并相互连接的系统机制,是Meta看重的核心价值。

机器之心
算法论文8

告别纯奖励试错!二次尝试+反思蒸馏,复杂任务提升81%

美国南加州大学和宾夕法尼亚大学团队提出新训练范式ERL,将「经验学习」引入强化学习,通过二次尝试和反思蒸馏,在复杂任务中性能显著提升,为构建长期自主智能提供新思路。

新智元
开源动态8

狂揽6.9K star!!微软又来一款王炸项目,实时跟踪、透明可控,牛皮!

微软开源项目Magentic-UI狂揽6.9K star。它是“以人为本”网页智能助手,基于AutoGen框架,可让用户全程掌控,能实时跟踪、透明可控,有协同规划等功能,适合测试、分析等人员。

开源先锋
开源动态8

继Harness之后,“龙虾”JiuwenClaw率先开启“Coordination Engineering”时代

AI工程范式迭代快,行业面临‘定义赶不上进化’的焦虑。华为支持的openJiuwen社区发布新版JiuwenClaw,新增多智能协同能力,提出‘Coordination Engineering’,实测中表现出高稳定性,可自主完成多项任务。

量子位
新闻资讯8

百度想明白了:旧供给到达极限了

当下企业应用AI时,Token成本高、推理效率低问题凸显。百度Create大会释放旧供给达极限信号,推出新全栈AI云,含Agent Infra和AI Infra两层架构,多个场景应用初显成效。

InfoQ
算法论文8

告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场

过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能裁判,还阐述了其优势、发展阶段等。

深度学习自然语言处理
算法论文8

“这个怎么组装?”一句无害的问题,如何让AI产生危险输出

Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。

深度学习自然语言处理
新闻资讯7

重建安全,Kai种子轮拿了1.25亿美元,有点象龙虾

大模型用于网络攻击,传统安全跟不上节奏。初创公司Kai首笔融资1.25亿美元,它从根本上重建安全,用单一智能AI平台自主完成安全工作,愿景是整合网络安全和IT功能。

AI与安全
新闻资讯8

刚刚,中国AI天团杀向RSI!1分钟预测全球天气、20分钟手搓OS

本文报道上海人工智能实验室等多家机构联合发布智能模型Atria Dawn Preview,该模型可1分钟预测全球天气、20分钟搭建MiniOS,团队同时分析AI研发中的人机分工,披露最新协作数据。

新智元
算法论文7

多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准

香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。

机器之心