「通用科学智能体」共找到 4079 篇相关文章
告别死记硬背!SkillRL自动提炼Skills持续进化
大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。
刚刚Gemini上新模型,全球只有7人比它会编程,谷歌姚顺宇参与
北京时间周五凌晨,谷歌发布Gemini 3 Deep Think重大升级,在多学术基准测试中取得佳绩,成本大幅降低,编程能力超多数人。在多科学领域表现出色,还推动了实际应用,已上线供部分用户使用。
有一说一,老周还真的挺懂 Agent 的
360 AI 发布会,老周回应市场部一事,称是让员工养成用 AI 习惯。他懂 Agent,认为其将成 AI 应用标准形态,360 从搜索切入,推出纳米 AI 超级搜索智能体,还发布两款 AI 硬件。
被高薪吸引却遭愚弄!科学家怒曝AI科研黑幕:多为个人“捞金”,DeepMind百万成果是“垃圾”
物理学家 Nick McGreivy 分享应用 AI 做研究的经历,指出 AI 方法在解决偏微分方程上远不如宣传,如 PINN 效果差。还提到 DeepMind 成果遭质疑,研究存在数据泄露、报告偏差等问题,AI 加速科学或被夸大。
字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还能超越百亿级对手
传统code大模型依赖人工筛选数据,成本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性能超百亿级对手,不过也存在通用和数学能力短板。
闭源RSI的严父来了:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5
开源AI基础设施公司Prime Intellect研究表明,借助多智能体Harness,让开源模型负责监控和实现,可让‘AI开发AI’更便宜、效果更好。实验中,Kimi K3搭配Harness逼近Opus 5。
60000小时炼出新开源VLA!20多种机器人都能用
蚂蚁灵波发布开源VLA模型LingBot-VLA 2.0,用60000小时预训练数据“喂”出。它支持20多种机器人构型,融合LingBot-Depth提升空间理解,还学会预测未来,在GM - 100评测表现佳。
具身Scaling Law押对了!独角兽新品1小时学会新任务,重复1800次成功率99%
具身智能独角兽Generalist推出新模型Gen - 1,它在精细任务上表现出色,成功率大幅提升、效率加快,验证了机器人领域的Scaling Law。研发团队重写数据处理架构,采用新技术提升性能。
破防了!全球顶尖AI惨败,人类最后防线竟是「重启试试」?
GSMA联合权威组织发起全球电信AI故障排查挑战赛,吸引超1000支队伍。赛事依托权威评估框架,设丰厚奖励,分多个赛道,还将开展智能体任务,预示电信运营模式重构。
GPT-5.2连肝7天,300万行代码造出Chrome级浏览器
Cursor的CEO让GPT - 5.2连续运行一周,产出300万行代码,从零构建Chrome级浏览器。还介绍不同模型长任务表现、多智能体协作架构,指出这将颠覆软件开发经济学。