「端到端具身大模型」共找到 9131 篇相关文章

产品应用8

今天,被GLM-5的Agentic Coding能力惊艳到了

上月底Anthropic报告揭示编程趋势转变,月初Claude Opus 4.6与GPT - 5.3 Codex发布印证。作者深度测试GLM - 5,经两项实测挑战,发现其在复杂系统任务表现超预期,有‘系统架构师’思维。

PaperAgent
算法论文8

首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈

厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成器与求解器共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。

机器之心
产品应用8

借助 AI Coding 快速打造 AI Agent 系统

文章围绕购物场景生成AI Agent系统展开,原有低代码方案遇瓶颈,团队转向LangGraph等工程方案,借助AI Coding工具重构上线。介绍了项目需求、挑战,阐述核心架构升级,分享AI Coding开发实践及项目成果与启示。

阿里云开发者
新闻资讯7

传Claude sonnet 5即将发布:能自动组建开发团队,一人即一公司,价格爆降50%

小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全新功能,能化身虚拟开发团队,编程能力强,价格将降50%,还与谷歌深度合作。

AI寒武纪
新闻资讯7

Docker 通过 Cagent 提供 AI 代理确定性测试

AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。

InfoQ
新闻资讯7

Claude想接管世界?Anthropic联合创始人连夜向神父求救

估值1830亿美元的AI独角兽Anthropic,为旗舰模型Claude注入「灵魂」,请天主教神父Brendan McGuire批注「AI宪法」。工程师发现Claude有「接管世界」倾向,代码约束失效,需更形而上的东西。

新智元
新闻资讯7

AI Agent 是长期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了

AI安全公司CyberArk首席软件架构师Niv Rabin团队提出基于“指令检测”与“历史感知校验”的方法,防御大语言模型和AI Agent恶意输入与历史投毒攻击,介绍多种防御机制。

InfoQ
开源动态8

Clawdbot:火爆硅谷,让开发者疯抢Mac mini的AI新物种

Clawdbot是诞生仅三周的开源项目,让AI走出聊天框成数字同事。它由退休程序员Peter Steinberger推出,能24小时运行在本地电脑,解决AI落地难题。许多开发者为此抢购Mac mini。

AIGC开放社区
新闻资讯7

奥特曼小号泄密:OpenAI代码工作100%交给Codex!工程师才揭底Codex“大脑”运行逻辑,碾压Claude架构?

近日,OpenAI工程师揭秘Codex“大脑”运行逻辑,介绍其智能体循环及构建提示词等过程。还提及用1个PostgreSQL主库和50个只读副本顶住8亿用户,同时持续探索数据库性能极限。

AI前线
算法论文8

机器人终于「懂」家务了!伯克利MomaGraph让机器人像人一样做家务

过去家用机器人做家务存在诸多难题,最近加州伯克利和马里兰大学联手推出 MomaGraph 技术。该技术采用「Graph - then - Plan」思路,团队搭建了完整体系,在星动 Q5 上测试效果好,让家用服务机器人迈向实用。

机器之心