代码推理」共找到 3504 篇相关文章

算法论文8

用更一致的轨迹、更少的解码步数「驯服」掩码扩散语言模型,扩散语言模型的推理性能和效率大幅提升

扩散大语言模型发展迅猛,或成下一代大语言模型基础范式有力竞争者。复旦大学等团队发布论文,提出高效解码策略与强化学习训练组合,解决MDLM解码和训练问题,提升推理性能与效率。

机器之心
产品应用8

16 年老程序员用 Claude Code 搞副业:我只手敲了 1000 行,剩下 95% 代码靠自动生成

Anthropic公司的AI编码助手Claude Code推出4个月吸引11.5万开发者,单周处理代码量达1.95亿行,预估年化收入约1.3亿美元。开发者Indragie用其构建macOS应用,2万行代码中手写不到1000行,还分享使用技巧与体验。

InfoQ
推荐文章7

“如果你不能用300行代码写个Cursor,这行你就别待了!”Ralph Loop创造者、Claude Code核心技术设计者的暴论

Ralph Loop 创造者 Geoffrey Huntley 在播客称软件开发已死,任何人用 Cursor 就能生成代码。他还谈到 K 型分化下职业生存法则、Ralph Loop 设计哲学、代码审查问题,并给出学习和职业发展建议。

InfoQ
算法论文8

AST | 西交大牛笑天、陈刚等:基于多尺度网格融合技术的复杂三维构型流场时空智能推理方法

文章针对复杂三维外形的强非线性非定常流场推理难题,提出MSGF数据预处理方法与DTECAU - 3D模型联合框架。MSGF解决数据提取难题,DTECAU - 3D解决传统U - net问题,经测试验证该框架效果良好。

力学与人工智能
算法论文8

ICLR 2026 Oral|大模型总爱「想太多」? DECS从源头消除冗余思考,实现推理token减半且性能不降反升

以DeepSeek - R1等为代表的大型推理模型存在过度思考问题,造成大量冗余计算。复旦大学等团队在ICLR 2026 Oral论文中揭示‘长度惩罚’局限性,提出DECS框架,在多基准测试中实现推理长度减半且性能提升。

机器之心
开源动态8

NeurIPS 2025 | 中科大、港中深、通义千问联合发布CoRT:仅30个样本教会大模型高效推理,token消耗降低50%

大型推理模型在精确数学计算上存在问题,如认知冲突、行为低效、数据稀缺。中科大、港中深、通义千问联合推出CoRT框架,用创新数据合成与多阶段训练,提升模型推理能力和效率,成果已开源。

机器之心
推荐文章7

AI 已能写 80% 代码,但 Agent 也有致命短板!OpenAI Codex 技术总监:问错了,比不会写更麻烦

OpenAI Codex 技术负责人 Michael Bolin 在访谈中回顾职业轨迹,分享从工程师到工具创造者的成长经历。他认为 AI 编程时代 80%-90% 代码可由模型生成,但关键部分需人类把控,提出正确问题能力更重要,编程智能体执行将更多迁移到云端。

InfoQ
新闻资讯7

大模型年中报告:Anthropic 市场份额超 OpenAI,开源模型企业采用率下降

本文基于年中报告指出,当前模型API支出翻倍,企业重心转向模型推理。Anthropic市场份额超OpenAI,开源模型企业采用率下降。代码生成成热门场景,企业换模型重性能,AI支出从训练转推理

Founder Park
开源动态8

DeepSeek出品,必是精品!DeepSeek-OCR 2发布:让LLM像人一样读懂复杂文档,效果超Gemini 3 Pro

DeepSeek推出DeepSeek-OCR 2,提出“视觉因果流”,以全新视觉编码器赋予模型因果推理能力。它在文档解析基准表现超Gemini 3 Pro,代码和模型权重已开源,为2D推理和原生多模态探索铺路。

AI寒武纪
开源动态8

NVIDIA发布最强开源模型,效果和速度全面超越DeepSeek R1

NVIDIA推出Llama - Nemotron系列开源模型,有LN - Nano、LN - Super、LN - Ultra三款。旗舰款LN - Ultra在权威测评中碾压DeepSeek - R1等,运行效率还更高。有“动态推理开关”功能,代码数据全公开,或引发AI推理效率革命。

深度学习自然语言处理