「数学顶刊」共找到 821 篇相关文章
太巅了!MIT老哥在Transformer里造了台计算机,LLM从此不需要调用外部工具?
LLM在数学推理表现佳,但纯计算是短板。MIT的Christos Tzamos团队在Transformer内造计算机,实现WebAssembly解释器,解决数独难题,还突破注意力机制瓶颈,打开软件与神经网络新接口。
鹅厂门口免费装龙虾,几百人排爆了!一代人有一代人的鸡蛋要领
腾讯云工程师在鹅厂门口免费为几百人安装OpenClaw,提供“从装到玩”服务。OpenClaw是开源智能体框架,像“龙虾”,可自动操作电脑。目前GitHub Star数超27.04万,多家公司跟进。
数据邪修大法好:仅用文本数据就能预训练多模态大模型
多模态大模型研发中,行业认为无图文对就无多模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。
世界模型原生新一代范式!极佳视界斩获全球第一后,GigaBrain-0.5M*再进化
具身世界模型新一代原生范式登场,GigaBrain-0.5M*在多真实机器人任务中数小时零失误。它依托世界模型,创新引入人在回路机制,研发采用四阶段闭环训练流程,优势显著。
刚刚,Anthropic 发布 Claude「宪法」:一份写给 AI 的人生指南
Anthropic 公开给 Claude 写的数万字「宪法」,从「规则清单」升级为「价值体系」,设定四个核心价值,有「聪明朋友」理论,设硬性限制,对诚实要求严格,还探讨意识等问题,强调透明度和持续进化。
上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!
上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。
全自研仿真GPU求解器x虚实对标物理测量工厂,打造具身合成数据SuperApp,加速具身仿真生态丨光轮智能@MEET2026
在量子位MEET2026大会上,光轮智能杨海波指出具身智能核心是数据,仿真是解决数据问题的唯一方案。光轮智能自研“测量、生成、求解”基础设施,建立全栈仿真平台,还打造多个“爆品应用”,为具身智能发展提供支撑。
近期,谷歌发了两篇Agent Scaling论文,有点东西
2025年LLM社区有Test - Time Scaling和Agent化两条主线,但‘更多agent是否更好’无人能定量回答。谷歌两篇论文将agent scaling拆成可预测、可度量的科学问题,涉及预算感知和多agent盈亏平衡点。
国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5
蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。
让大模型合成检查器:UIUC团队挖出Linux内核90余个长期潜伏漏洞
伊利诺伊大学香槟分校张令明老师团队的论文提出KNighter,它让大模型生成静态分析检查器,在Linux内核挖出92个长期潜伏漏洞,将LLM归纳能力沉淀为规则,带来可落地等好处。