大语言模型」共找到 9359 篇相关文章

新闻资讯7

RLHF已死,RLVR引爆AGI革命!Claude 4核心成员万字对谈

Claude 4核心成员对谈指出,强化学习在语言模型上奏效,可验证奖励的强化学习(RLVR)比RLHF更优,模型有望从「专才」向「通才」过渡,未来AI智能体将完成白领工作,人们应做好准备。

新智元
算法论文8

NVIDIA提出小型LLM才是未来,并将重塑Agentic AI

人工智能代理快速渗透企业场景,但当前系统依赖语言模型,存在经济成本和效率错配痛点。NVIDIA团队提出小型语言模型才是代理AI未来,论证其能力、经济性和操作适配性优势,并给出迁移路径。

深度学习自然语言处理
新闻资讯8

100万亿Token看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?

OpenRouter和a16z联合发布报告,基于100万亿Token实证数据揭秘2025年AI发展。开源模型流量占比达30%,推理模型成主流,编程和角色扮演是主要使用场景,亚洲付费使用量翻倍,中文成全球第二交互语言

新智元
算法论文8

LeCun新作反杀AGI派!AI连「鸟」都搞不懂,拿什么超越人类?

图灵奖得主Yann LeCun联手斯坦福团队最新论文揭示,LLM仅在粗糙分类任务表现优秀,精细任务却失灵。研究测试30多个模型,得出三发现,指出LLM与人类在概念形成和信息处理上存在本质差异。

新智元
新闻资讯8

讯飞刚发的财报:净利润暴涨了202%

讯飞2025年第三季度财报亮眼,营收、利润、现金流全面转正,归母净利润同比增202%。AI模型技术突破与产业化落地成业绩修复关键,在技术、业务、生态方面成效显著,还将加研发投入。

量子位
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手

OpenAI研究员官宣其内部研发的AI推理系统在2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统在模拟人类环境下靠推理解题,用通用模型,一年间成绩逆转,近期在多赛事表现出色。

AI寒武纪
算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型和数据集上性能提升显著。

深度学习自然语言处理
算法论文7

上交和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?

硅谷Taalas将模型‘物理焊死’进芯片引关注,而上海交、辉羲智能与微软亚洲研究院团队用ROM+SRAM异构架构,将端侧LLM推理速度推至20,000 tokens/s。介绍了ROMA和TOM架构优势及应用场景。

新智元
算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
新闻资讯7

刚刚,苹果WWDC掀AI重构风暴!端侧模型全开放、AI版Siri却成最「鸽」王

北京时间今天凌晨,苹果全球开发者会 WWDC 召开。苹果宣布系列系统更新,展示 AI 融入产品计划,开放端侧模型,推 Xcode 26。但增强版 Siri 跳票,股价下跌,网友不满。

机器之心