「科学自主性」共找到 1236 篇相关文章
全球首个AI Agent操作系统FlowithOS跑分超Atlas,网友:它「杀死」了比赛
AI应用初创企业Flowith推出全球首款专为AI Agent打造的操作系统FlowithOS。它能改写交互方式,功能超AI浏览器,跑分超竞品,还具记忆能力,适配多系统,已公测,或引发“AI操作系统”竞争。
Yoshua Bengio,刚刚成为全球首个百万引用学者!
计算机科学家Yoshua Bengio成Google Scholar上首个引用超百万的人。他是深度学习“三巨头”之一,在“AI寒冬”坚守研究,成果显著。如今他担忧AI风险,积极推动伦理准则和监管。
经典之作!Agent无需奖励也能学习:通过“早期经验”的Agent Learning
该论文提出‘早期经验’范式,让智能体通过执行动作、观察结果状态学习,无需外部奖励。它能降低数据依赖,提升泛化与鲁棒性。实验显示,其在多样环境中效果出色,为智能体训练提供新思路。
大模型“精细化”对齐,真实性提升25.8%刷新SOTA!token级精准编辑,无需训练即插即用
北航团队在EMNLP 2025提出Token - Aware Editing (TAE)方法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实性指标提升25.8%。
刚刚,LeCun团队开源首款代码世界模型!能像程序员一样思考的LLM来了
Meta官宣发布代码世界模型CWM,将世界模型引入代码生成任务。它基于编程和世界建模数据训练,能模拟程序执行与交互。在编程基准测试中表现不错,算是Meta的概念验证,目前可看作Demo。
MCP Registry 预览版上线:AI 开发的统一服务目录
Model Context Protocol 推出 MCP Registry 预览版,这是开放的 MCP 服务器目录和 API,可改善服务器可发现性。注册表开源,分公共和私有子注册表,采用社区举报机制,设计类似 Docker Registry。
从「会说」迈向「会做」,LLM下半场:Agentic强化学习范式综述
过去LLM训练多依赖PBRFT范式,但局限明显。2025年初起,Agentic RL新范式受关注。此综述论文梳理该方向,覆盖500+研究,构建理论框架,讨论未来挑战,助LLM从「会说」迈向「会做」。
DeepSeek 新模型曝光,即将发布
据彭博社消息,年初凭 R1 模型震动全球的 DeepSeek 正开发全新 AI Agent 模型,创始人推动团队在今年四季度发布。该模型能代表用户执行多步骤操作、基于过往行为学习改进,行业也在向 Agent 软件转型。
Claude Sonnet 4 支持百万上下文了,AI Coding 的想象力更大了
Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量为之前5倍。该功能已在部分平台公测,将推给更多用户。它支持复杂任务,有新定价和成本优化方案,获早期用户高度评价。
美国宣战,AI行动计划打响第一枪!「AI+材料」成最新核武器
美国白宫发布《美国AI行动计划》,将「AI+材料」推上国家级战略高度。该计划涉及投资AI赋能科学、构建数据集等五大重点领域,释放材料科学发展机遇信号,中国需全速追赶。