推理编程」共找到 3002 篇相关文章

新闻资讯7

传 GPT-5.6 明日发布:要打赢 Fable 5,光靠刷分可不行

近期GPT-5.6发布消息不断,上线或进入倒计时。它被拿来与Fable 5对比,Fable 5长任务处理出色,而GPT-5.5有短板。GPT-5.6虽跑分亮眼,但被指‘benchmaxxed’,还存在脱离现实常识问题。

AI科技评论
新闻资讯7

外行瞎写的Vibe Coding,都能并入Agent 工程了:最吓人的是,我们“摆烂”有正当理由了

本文编译了软件专家 Simon Willison 在播客的访谈内容。他指出 Vibe Coding 与 Agent 工程正走向融合,AI 写代码渐趋可靠,人类审查成开发瓶颈,还探讨了 AI 对编程的影响、算力成本博弈等问题。

InfoQ
开源动态8

开源打破“AI黑箱”!集结全球大咖,GOSIM Paris 2026带你看懂Agent时代大变局

GOSIM Paris 2026在巴黎举办,是面向开发者的开源AI技术大会。大会由GOSIM主办,CSDN等联合打造,聚焦AI能力落地应用。首日Keynote多位大咖探讨AI相关问题,还有三大论坛、工作坊、Hackathon等活动。

AI科技大本营
推荐文章8

《动手写AI Agent》前言 · 先看完成品

作者因想搞懂 Agent 原理,且市面上缺系统学习资料,决定手写一份教程,即《动手写 AI Agent》。书中 Ling 是从零手写的编程助手,介绍了其 8 个应用场景、技术规格,还说明了适合读者与全书路线图。

AI Reading Hub
算法论文8

论文精选 | 以AI赋能力学:计算力学的智能化之路与未来图景

中国力学学会旗舰期刊AMS推出“力学前沿”专栏,首期解读“计算力学的智能化之路与未来图景”。文章介绍智能计算力学三大范式、面临挑战,还阐述重塑智能框架前沿方向,指出AI与计算力学融合是系统性重构。

力学与人工智能
开源动态8

万亿思考模型夺下IMO金牌,无缝接入OpenClaw!一句话手搓丐版PS

2026年AI圈竞争激烈,闭源巨头巅峰对决时,开源社区迎来中国队的「技术核爆」。全球首个万亿级混合线性「思考模型」Ring - 2.5 - 1T开源,它能力强大,还能无缝接入Claude Code,实战表现亮眼。

新智元
产品应用8

1美元时薪?这才是打工人的「梦中情模」

Anthropic 的 Opus 4.6 好用但贵,MiniMax 推出 M2.5 与之抗衡。M2.5 在多方面表现卓越,参数量小,成本低,推理速度快,还经实测能成打工人得力助手,其背后有独特训练体系。

机器之心
开源动态8

GLM-5真够顶的:超24小时自己跑代码,700次工具调用、800次切上下文!

GLM - 5正式发布,把开源AI带入长任务时代。它超24小时自己跑代码,完成GBA模拟器,能力稳定。评测结果佳,在主流测试中编程能力与Claude Opus 4.5对齐,引发网友欢呼。实测还展现多种应用能力。

量子位
开源动态8

开源8300小时标注数据,新一代实时通用游戏AI Pixel2Play发布

随着AI在代码和图片生成领域成熟,研究人员开始关注其在游戏领域的表现。此前的专用模型缺乏跨游戏泛化能力,通用模型在游戏环境中表现不佳。为此,Player2研究员提出Pixel2Play模型,还开源了代码和数据集。

机器之心
推荐文章7

2025小结:从RL到Agentic RL

作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。

深度学习自然语言处理