数学推理能力」共找到 4703 篇相关文章

开源动态7

DeepSeek开源,Agent能力大升级,剧透2026!

DeepSeek昨晚更新并开源V3.2正式版及长思考增强版V3.2-Speciale,亮点是Agent能力进化。一年来它未增模型规模,靠架构优化等提升性能、降低成本,坚持自我路线很稳,V3.2继续提升能力

探索AGI
新闻资讯8

陶哲轩最新演讲:数学正在进入“工业时代”

当地时间7月24日,菲尔兹奖得主陶哲轩在2026年国际数学家大会上发表演讲,指出AI参与数学研究,或使数学站在类似历史节点,研究方式和价值体系受挑战,还探讨了AI对数学研究各方面的影响及应对方向。

DeepTech深科技
算法论文7

The Batch: 939 |在推理阶段学习长上下文

大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。

DeeplearningAI
算法论文8

告别「盲目自信」,CCD:扩散语言模型推理新SOTA

华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。

机器之心
开源动态7

1000 行 Java 代码手搓 OpenAI gpt-oss 推理引擎

2025年8月OpenAI发布gpt - oss,作者受相关项目启发,用约1000行Java代码实现gpt - oss推理引擎并发布在亚马逊官方github。文章分享开发体会,介绍模型架构、Java实现、性能优化等内容。

AI前线
产品应用7

OpenCode AI编程实践:利用推理路由低成本开发游戏

文章介绍用 OpenCode 结合 DigitalOcean 推理路由器开发点球大战游戏 PK Shootout。其按任务选模型,多数任务路由到 MiMo V2.5 和 GLM - 5.2,成本约 8.25 美元,远低于只用前沿模型。文中还分析开发各环节及适用场景。

AI工程化
新闻资讯7

中国AI芯片如何破局?这家公司重注推理芯片

2月3日,云天励飞董事长陈宁在战略前瞻会表示要All in AI大算力推理芯片,打造“中国版TPU”。他认为2025 - 2035年是推理芯片高光时刻,还介绍了公司技术壁垒、差异、战略及生态等内容。

芯师爷
算法论文8

低Token高精度!字节复旦推出自适应推理框架CAR

字节与复旦大学研究人员提出自适应推理框架CAR,能根据模型困惑度动态选短答或长推,在多基准测试中平衡了准确性与效率,打破长文本推理必然性能更好的认知。

量子位
开源动态8

开源多模态推理「破壁」时刻:MMFineReason助力4B逆袭30B

长期以来,开源多模态模型在复杂推理任务上与顶尖闭源模型有差距,核心痛点是高质量推理数据匮乏。上海AI实验室OpenDataLab团队开源MMFineReason框架及大规模数据集,小模型凭此实现性能逆袭。

机器之心
新闻资讯7

FriendliAI获2000万美元,以加速AI模型推理工作负载

专注AI推理的初创平台FriendliAI获2000万美元种子扩展轮融资,资金用于加速平台开发。其专有推理优化技术可降低模型运行成本和能耗,能为用户省90%的GPU成本,合作客户广泛。

AIGC开放社区