实验闭环验证」共找到 2167 篇相关文章

算法论文8

Meta华人实习生搞出超级智能体!自己写代码实现自我进化

Meta研究团队论文结合哥德尔机思想与达尔文开放算法,提出达尔文哥德尔机,进而定义超级智能体Hyperagents。它能持续自我迭代,实现元学习,实验证明其能有效自我提升,且改进有迁移性。

量子位
新闻资讯7

Cursor定价又更新,直接变成" 买API ",Coding 产品包月模式走不下去了

Cursor一年三变价,9月15号后个人版按模型推理用量计费,有Pro、Pro Plus、Ultra方案,还对大学生免费计划二次验证。因模型成本涨、竞争大,包月模式难以为继,多家编程工具都调整定价。

AI进修生
新闻资讯7

Anthropic滑跪认错!Claude暗中降智实锤

开发者argofowl排查后发现Claude Code将「high」推理程度读成原本「low」对应的值,原来Anthropic在做实验。科技博主曝光后AI圈炸锅,工程师虽回应,但Opus 5也被指降智。

新智元
算法论文8

让机器人学会「预判接触」:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题

它石智航联合四大顶尖机构发布论文 “TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在真机验证中性能优异。

机器之心
算法论文8

ACL 2026|证据摊开看,场景图画清:让流式视频大模型拿捏「何时开口」

随着多模态和大语言模型发展,人类与 AI 交互走向共生。现有视频大模型难把握响应时机,西北工业大学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。

机器之心
算法论文8

Claude Code被攻破「后门」,港科大&复旦研究曝出TIP漏洞

近期港科大与复旦研究指出,Claude Code命令行工具连接MCP服务器时,TIP可能被劫持致远程代码执行。研究用TEW框架测试验证漏洞,还给出真机案例,最后提出改进方向。

机器之心
算法论文8

原来Veo 3早有苗头!人大联合值得买科技在CVPR 2025提出全新「图像到有声视频」生成框架

中国人民大学与值得买科技团队在CVPR 2025提出JointDiT框架,可从静态图像生成同步音视频。此研究定义图像到有声视频生成新任务,解决音视频融合难题,实验显示其效果优,还将拓展至四模态建模。

机器之心
算法论文8

DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍

近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。

量子位
开源动态8

ROCK & ROLL!阿里给智能体造了个实战演练场 | 开源

阿里开源新项目ROCK,解决了智能体无法在真实环境中规模化训练的难题。它与阿里此前的RL训练框架ROLL配合,构成完整的智能体训练闭环,推开了Agentic AI规模化应用的大门。

量子位
算法论文7

会解题不等于懂人心,腾讯混元提出Sentient Agent,提高高阶社交认知能力

过去评判LLM像考核‘做题家’,但会解题不等于懂人心。腾讯团队提出SAGE框架,用会闹情绪的agent评委评估模型高阶社交认知能力。实验显示不同模型表现差异大,未来需懂人心的AI。

深度学习自然语言处理