「动态自感知能力」共找到 3693 篇相关文章
Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用全部token训练还好
Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。
CMU朱俊彦等上新LEGOGPT,一句话就能搭乐高,网友:复杂零件行不行?
近日,CMU助理教授朱俊彦团队带来基于文本生成3D乐高的大模型LEGOGPT,输入文本即可快速拼好乐高,生成的乐高还有纹理和颜色。研究人员让机器臂组装模型,结果完美。该模型仍有局限,团队正努力扩展能力。
AI 编程工具在大型企业“遇冷”?网易 CodeWave 升级研发模式,不只关注“代码生成”
近些年,自然语言编程成 AI 编程产品主流。C 端通用 AI coding 工具表现出色,但国内企业级市场 AI 技术渗透率低。网易 CodeWave 专注企业级场景,指出通用工具痛点,提出‘可控的 AI coding’定位并升级能力,未来还将推新开发模式。
从自己出题到自己选题:耶鲁新方法让大模型 Self-Evolution 又进一步
本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER大模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。
刚刚,Opus 5来了:性能不输 Fable 5、价格砍半
Anthropic 发布新一代模型 Claude Opus 5,其智能接近 Claude Fable 5 但价格减半。它在编程、知识工作等评测中表现出色,科研能力进步大,自主性与严谨性更强,安全对齐度高,防护兼顾安全与可用。
突发,打工版Claude 5来了!人人都能用
Anthropic推出Claude Sonnet 5,代号Fennec。它性能直逼旗舰Opus 4.8,即日起成所有Free和Pro用户默认模型,能自主规划等。价格有促销,虽tokenizer或使花销增加,但仍比Opus划算,防护能力也强。
OpenClaw逼出Claude最强反击!GUI操控电脑和真人无差别,网友:这得花多少token?
Claude Code升级Computer Use能力精准反击OpenClaw,基于GUI操作,像真人操控电脑。升级后无需API或CLI改造,能操控传统软件,还上线远程控制、定时任务功能,有安全分层设计。已向Claude Pro和Max用户开放。
Agent搜索哪家强?人大高瓴&快手联合发布全新评测基准GISA
人大高瓴与快手联合发布全新评测基准GISA,用于评估智能体搜索能力。它解决了现有基准反向构造、评估维度单一、答案易被记忆等问题,含373个高质量查询,实验显示当前搜索智能体距人类水平差距大。
比SOTA快9倍,谷歌DeepMind时空重建,把视频变成时空搜索引擎
谷歌DeepMind联合团队发布D4RT时空重建框架,颠覆传统视频转3D方法。它按需提问,像搜索引擎,处理动态视频高效。内部结构分编码、解码两步,速度快,还发明聪明收割机算法,在多项测试中表现优异。
爆发力超越波士顿动力液压机器人,PHYBOT M1实现全球首次全尺寸重型电驱人形机器人完美拟人态后空翻
动易科技的全尺寸人形机器人PHYBOT M1实现全球首次全尺寸重型电驱机器人完美拟人态后空翻,其爆发力超波士顿动力Atlas。这是对其动态性能的压力测试,电驱系统也在多方面超越液压方案。