大推理模型」共找到 9496 篇相关文章

新闻资讯8

谷歌2025「复仇爽文」结局!从至暗时刻到王者归来

2025年谷歌上演AI复仇戏,年初被唱衰,年底凭Gemini 3等组合拳重回巅峰。在模型、开发、创意等8领域突围,还兼顾安全责任。全年各月不断推新,涵盖系统、工具、模型等多方面。

新智元
算法论文8

吴恩达新作:87%推理token用不着,丢掉反而快3倍

吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。

PaperAgent
开源动态8

没想到,音频模型开源最彻底的,居然是小红书

近几个月,开源成AI社区焦点,国内厂商七八月开源多款模型,但音频生成占比小。小红书技术团队自去年起在音频领域稳定开源,成果覆盖TTS、ASR方向,具商用属性,降低落地门槛。

机器之心
开源动态8

谷歌最强AI,被港科开源超了?让海外创作者喊出「King Bomb」的P图杀器来了

图像编辑与生成模型爆发,冲击Photoshop地位。港科贾佳亚团队开源DreamOmni2,优化升级多模态指令编辑与生成能力,效果获海外创作者认可,还在实测中表现出色,其采用创新技术方案构建多模态生成体系。

机器之心
新闻资讯8

Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒

Anthropic的Alignment Science团队研究语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型攻击越易,还对微调数据集实验,引发讨论。

InfoQ
8

AI教父Geoffrey Hinton,全球第二个百万引用科学家!

AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑模型运行。他还称模型是黑箱,领域待探索。

新智元
算法论文8

SeePhys Pro:重新审视多模态物理推理中的视觉理解与训练收益

来自中山学等的研究者提出SeePhys Pro,是面向多模态物理推理的细粒度评测与训练诊断框架。发布了benchmark、训练集等,测评显示当前模型在信息模态转变时不稳定,为模型评测和训练研究提供基础。

AI科技评论
算法论文8

告别「利用率崩溃」:GIPO开启模型强化学习高效训练新方法 | ICML 2026

树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。

AI科技大本营
开源动态8

AAAI 2026 Oral|InfiGUI-G1模型来了,刷新GUI Grounding SOTA

多模态语言模型发展下,GUI Grounding任务是难题,现有RLVR方法有瓶颈。浙江学等团队提出AEPO框架,推出InfiGUI - G1系列模型,小参数量刷新GUI基准测试SOTA,代码已开源。

机器之心
新闻资讯8

学界佬吵架金句不断,智谱和MiniMax太优秀被点名,Agent竟然能写GPU内核了?!

卡内基梅隆学助理教授蒂姆·德特默斯与加州学圣地亚哥分校助理教授丹·傅,就AGI是否会实现展开争论。他们还谈到算力、Agent应用等话题,看好小模型、开源模型等发展,认可中国模型进步。

InfoQ