大模型竞争」共找到 9613 篇相关文章

算法论文8

颠覆搜索引擎,下一代Agentic Deep Research!12家顶尖学术机构联手提出

在信息获取方式变革背景下,12家顶尖机构联合发布论文提出Agentic Deep Research,它由模型驱动,可自动规划检索路径等,或颠覆传统搜索范式,且有基准成绩和TTS Law支撑,开源生态也在聚焦。

新智元
算法论文8

无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码

港中文(深圳)和上海交通学团队提出 StreamBP 算法,通过线性分解和分步计算,将语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最序列长度为其 2.8 - 5.5 倍,代码已开源。

机器之心
新闻资讯7

AI七个月突破数学家“围剿”反超人类!14位数学家深挖原始推理token:不靠死记硬背靠直觉

模型o3 - mini - high在7个月内,于FrontierMath基准测试中,答题得分从2%提升到22%,超人类团队平均水平。数学家分析其推理记录,发现它靠直觉而非死记硬背解题,但也存在缺乏创造力等局限。

量子位
算法论文8

阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning

阿里与清华研究发现,训练语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理
产品应用8

拓宽百年奥运「赛场边界」,阿里云AI让人人皆可上场

阿里云作为2026年米兰冬奥会官方云服务合作伙伴,联合发起全球AIGC赛,用万相模型生成冬奥视频参赛。万相Wan2.6性能出色,在画质、叙事等方面表现成熟,让普通人也能在奥运体验中当主角。

机器之心
新闻资讯8

黄仁勋台上最强GPU炸场,台下感叹“中国芯片爆发”,瞄准6G投资诺基亚

英伟达发布会上,黄仁勋官宣新GPU Vera Rubin,还谈及中国芯片爆发,夸中国模型成果显著。此外,英伟达公布量子计算、6G通信等领域布局,与诺基亚合作入局6G并投资,不过各领域均面临竞争

量子位
推荐文章8

AI三问:Agent、LLM、RAG,一文厘清!

文章介绍语言模型(LLM)、检索增强生成(RAG)和AI智能体(Agent)三种架构。阐述其概念、工作原理、应用场景、优缺点,还做了横向对比,给出选用建议,最后提及混合架构与未来趋势。

MCP Lab
新闻资讯7

硅谷VC新玩法"Kingmaking":还没写代码也能拿到上千万投资

过去半年,三家未成型AI公司各获超5000万美元投资。如今VC采用“造王术”,在代码未写时就砸钱。因模型烧钱、头部效应强,投资人想用钱堆出“冠军”,这也给小团队带来机会。

AI工程化
新闻资讯7

张雪峰灵魂发问:30岁程序员年入百万,30岁医学生还在实习,你选哪条?

张雪峰发问,30岁程序员年入百万,30岁医学生还在实习,该选哪条路。文章分析指出,程序员来钱快但竞争、易被淘汰,医生起步慢却稳定、后期收入可观,关键是要选能扛住节奏的职业。

开源先锋
开源动态8

MIRIX重塑AI多模态长期记忆:超Gemini 410%,节省99.9%内存,APP同步上线

UCSD和NYU团队推出开源的MIRIX,全球首个多模态、多智能体AI记忆系统。它表现亮眼,在多任务中超越传统方法,有类人记忆系统等特点,还上线Mac端应用,开启模型从对话生成到长期记忆驱动心智的新周期。

机器之心