F2LLM」共找到 2796 篇相关文章

产品应用7

SDD 如何在复杂业务系统中真正落地?

文章围绕SDD在复杂业务系统落地展开,介绍OpenSpec库使用,对比与系分差异,分析其优势与问题,如LLM与IDE执行能力鸿沟、无update命令等,还对比OpenSpec和GitHub Spec Kit,并给出流程及提示词。

阿里云开发者
新闻资讯7

AI七个月突破数学家“围剿”反超人类!14位数学家深挖原始推理token:不靠死记硬背靠直觉

大模型o3 - mini - high在7个月内,于FrontierMath基准测试中,答题得分从2%提升到22%,超人类团队平均水平。数学家分析其推理记录,发现它靠直觉而非死记硬背解题,但也存在缺乏创造力等局限。

量子位
产品应用8

微信自研高性能推理计算引擎 XNet-DNN:跨平台 GPU 部署大语言模型及优化实践

本文深入解析微信自研的高性能推理计算引擎 XNet-DNN,介绍其核心技术架构和性能优化策略。该引擎基于 RCI 框架构建跨平台 GPU LLM 推理能力,在多方面超越现有解决方案,还给出了详实对比实验数据。

腾讯技术工程
算法论文8

ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御

合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。

机器之心
算法论文8

AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场重构研究

传统高保真CFD模拟计算资源消耗大,现有深度学习方法处理三维流场重建面临挑战。本文提出物理约束双并行注意力UNet++框架,实验表明其在流场重构精度上较传统U - Net提升约10%,预测速度提升2 - 3个数量级。

力学与人工智能
产品应用7

谷歌IMO金牌模型可以用了!推理性能秒了o3、Grok 4

谷歌拿下IMO金牌的模型Gemini 2.5 Deep Think已在Gemini App推出,速度更快、实用性更强。该模型仅对Ultra订阅用户开放,月费约1803元。其推理性能超o3、Grok 4,有迭代开发等优势。

量子位
新闻资讯7

刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想

本周五,谷歌向 Google AI Ultra 订阅用户推出 Deep Think 功能,提供全版本 Gemini 2.5 Deep Think 模型给部分数学家。该模型是获 IMO 金牌模型变体,速度更快,有并行思维等技术,在多领域有用且测试成绩优。

机器之心
产品应用8

拓宽百年奥运「赛场边界」,阿里云AI让人人皆可上场

阿里云作为2026年米兰冬奥会官方云服务合作伙伴,联合发起全球AIGC大赛,用万相大模型生成冬奥视频参赛。万相Wan2.6性能出色,在画质、叙事等方面表现成熟,让普通人也能在奥运体验中当主角。

机器之心
算法论文8

EMNLP2025 | 探究大语言模型的语言共享神经元提升低资源语言能力

论文提出BridgeX - ICL方法提升LLM低资源语言性能,通过三步实现优化。构建两类探测数据解决传统问题,识别重叠神经元,用HSIC选最优桥梁语言,在多任务实验验证其有效,揭示多语言机制规律。

深度学习自然语言处理
推荐文章8

为什么Claude Code 如此好?「以及如何在自己工作流中复刻Claude Code体验」

本文分析Claude Code好用的原因及如何复刻其体验。作者抓包分析其请求后给出要点,如可调试性优先、保持单一循环、LLM搜索优于RAG等,还阐述控制循环、提示词、工具等设计方法。

AI寒武纪