新模型Spud」共找到 9298 篇相关文章

新闻资讯7

谷歌约战,DeepSeek、Kimi都要上,首届大模型对抗赛明天开战

太平洋时间8月5 - 7日,8款前沿AI模型将在Kaggle Game Arena展开为期3天的国际象棋比赛,参赛方都是AI界顶流。谷歌称现有基准测试难跟上模型发展,这场比赛是探索评估方法。赛制为单败淘汰制。

机器之心
开源动态8

NeurIPS 2025 | 蚂蚁CGM:图融合架构重塑代码大模型,探索非 Agent 范式

在NeurIPS 2025上,蚂蚁将展示Code Graph Model (CGM)。它把代码库图结构集成到开源LLM,开启范式,在代码库级任务上以非Agent方案登顶开放权重模型榜首,解决了复杂软件工程的Agent依赖难题。

PaperAgent
算法论文7

估值840亿AI实验室再放大招,他们要给大模型戴上「紧箍咒」

智元报道,OpenAI前CTO创办的Thinking Machines Lab发布研究「模块流形」,将传统数值修正转为「预防式」约束优化。它提出范式,为训练大模型提供思路,还介绍了流形优化器及相关算法。

新智元
新闻资讯7

全网疯传!Claude最模型意外曝光:全面碾压Opus 4.6,强到让Anthropic不敢发布

Anthropic“手滑”泄露最强模型Claude Mythos,它在编程、推理和网络安全测试中表现超Claude Opus 4.6。因模型“黑客能力”强,Anthropic发布谨慎。此外,该公司还意外泄露3000多未发布文件。

AI前线
新闻资讯7

深度解读 AGI-Next 2026:分化、范式、Agent 与全球 AI 竞赛的 40 条重要判断

文章总结了 AGI-Next 2026 活动上核心观点。指出模型分化是趋势,有 To B 和 To C 等场景差异;自主学习是范式;模型即 Agent,Agent 即产品;还分析了中美 AI 竞赛的现状与挑战。

海外独角兽
算法论文8

英伟达再出手!型混合架构模型问世,两大创实现53.6倍吞吐提速

英伟达研究者提出混合架构语言模型 Jet - Nemotron,在达 SOTA 全注意力模型精度时效率卓越,2B 版性能超 Qwen3 等,H100 GPU 上生成吞吐量最高加速 53.6 倍,基于 PostNAS 和 JetBlock 两大创

机器之心
算法论文8

AAAI 2026 Oral | 大模型「爱你在心口难开」?深度隐藏认知让推理更可靠

合肥工业大学团队提出大模型存在‘隐藏的真伪认知’,论文让模型用此给推理‘打分’,过滤错误推理链。通过多层注意力头探测、构建预测器和推理扩展策略,提升了推理链稳定性,实验效果优异。

机器之心
算法论文8

模型做法!Meta|提出“类别专家汤”:SoCE,大幅提升模型性能,刷SoTA!

大语言模型领域,提升性能常需高算力、大量数据和长时间训练。Meta提出模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷SOTA记录,为开源社区指明低成本进化之路。

AINLPer
算法论文8

不改模型也能提升推理性能?ICLR投稿提出测试时扩展范式OTV

ICLR 2026投稿论文提出单token验证(OTV),是测试时扩展机制,让模型能边推理边判断正误。它基于并行思考思路,借助轻量内部验证器分析推理过程,实验显示其性能优于主流方法。

量子位
算法论文8

TPAMI 2026 | 北大彭宇团队提出CPL++框架,实现视觉定位模型的「自知之明」和「自我纠错」

北大彭宇教授团队提出CPL及进阶版CPL++框架。CPL用单模态匹配构造伪标签,引入静态验证模块;CPL++进一步自监督升级,具备纠错能力。实验显示,CPL++缩小了弱、全监督方法性能差距。

机器之心