多代理场景」共找到 5420 篇相关文章

算法论文8

启发学习:让大模型认知从外化到内生

当下大模型能力靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。

机器之心
新闻资讯7

Meta正炼化老板:24小时不间断工作,扎克伯格真成机器人了

《金融时报》爆料,扎克伯格正将自己炼成“代理CEO”扎克bot,由其影像和语音数据训练,本人也参与其中。超级智能实验室攻克相关技术难题,Meta还开发“CEO Agent”,但项目上线或面临问题。

量子位
新闻资讯7

全网疯传!Claude最新模型意外曝光:全面碾压Opus 4.6,强到让Anthropic不敢发布

Anthropic“手滑”泄露最强新模型Claude Mythos,它在编程、推理和网络安全测试中表现超Claude Opus 4.6。因模型“黑客能力”强,Anthropic发布谨慎。此外,该公司还意外泄露3000未发布文件。

AI前线
新闻资讯7

MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!

AI发展迅猛,现有基准测试难以跟上其步伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。

新智元
新闻资讯8

情人节最硬核“Kiss”!中国AI突破300年亲吻数难题,连刷维度纪录

中国AI打破300年的亲吻数难题。上海科学智能研究院等团队提出PackingStar系统,刷新维度世界纪录。它将难题转化为智能体博弈,成果获高度评价,还体现了AI for Science 2.0特质。

量子位
开源动态8

社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景

Hugging Face
算法论文8

Transformer已死?DeepMind正在押注另一条AGI路线

谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在任务表现出色,或开启AI从被动训练到主动进化大门。

新智元
开源动态7

测试的同学要起飞啦, Cursor / Claude 党福音:一个 MCP 服务器把 Android 真机接进你的对话框

DroidMind是开源MCP服务器,将Android的ADB能力结构化暴露给支持MCP的AI客户端。适合调试、测试等场景,能让AI执行设备操作,有设备管理、调试信息获取等功能,使用体验友好且安全。

小华同学ai
新闻资讯7

GPT-5.2发布,OpenAI十周年纪念版更新。

OpenAI在成立十周年之际发布GPT-5.2。此次更新让其在真实工作场景更实用,包括PPT/表格制作能力升级、前端编码能力惊艳、视觉能力细节处理更强、工具调用意识领先等。

开源AI项目落地
新闻资讯7

华人40%霸榜!2026 IEEE Fellow名单出炉,清华国内第一

美国电气电子工程师学会公布2026年Fellow名单,约40%是华人。国内所高校和机构有学者入选,如清华、北大等。IEEE Fellow是学会最高等级会员,表彰专业领域杰出成就者,每年晋升比例不到0.1%。

新智元