开源动态8
LeCun团队开源首个代码世界模型CWM
量子位
AI 摘要
Meta FAIR推出代码世界模型CWM,参数量32B。它能模拟代码执行、自测自修、推理规划,在多任务评测成绩佳。不过目前仅支持Python,定位研究用,不适合对话。
阅读原文 · 量子位
LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典
Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文7
Meta:给缩放律加指数,提升外推准确性
大模型训练前,团队常用 Chinchilla 缩放律估算模型规模和数据量,但它在模型和数据极不平衡的边界预测易跑偏。Meta FAIR 提出的 Skaling 只增加一个耦合指数,降低外推误差,还采用 L 形采样降低试算成本。
深度学习自然语言处理
新闻资讯7
马斯克:AI直出二进制,大佬集体回怼
马斯克在X上称代码正变成下一个汇编,要让AI直接生成二进制,摒弃“源代码”。此言论引发争议,UML之父、《代码整洁之道》作者等教父级人物纷纷回怼,而现实中AI生成代码已成趋势。
新智元
新闻资讯7
Karpathy:Opus 5 10 美元造出中土 3D 世界
Andrej Karpathy 用 Opus 5 结合《指环王》开篇文字,花约 10 美元让其渲染 3D 游戏。Opus 5 两小时写出 5500 行代码生成 3D 世界,虽粗糙但证明 AI 强大。不过,LLM 无法高效审查自己工作,这是弱点。
新智元
开源动态7
Stripe测试:AI智能体校验环节有短板
Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑等方面。
InfoQ