通用大模型」共找到 9351 篇相关文章

新闻资讯7

模型年中报告:Anthropic 市场份额超 OpenAI,开源模型企业采用率下降

本文基于年中报告指出,当前模型API支出翻倍,企业重心转向模型推理。Anthropic市场份额超OpenAI,开源模型企业采用率下降。代码生成成热门场景,企业换模型重性能,AI支出从训练转推理。

Founder Park
算法论文8

绝对零监督Absolute Zero:类AlphaZero自博弈赋能模型推理,全新零数据训练范式问世

清华学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了模型对人工数据依赖难题。

机器之心
新闻资讯8

火线解析MiniMax招股书!全球领先模型成本只有OpenAI 1%,果然拳怕少壮

上海模型独角兽MiniMax通过港交所聆讯冲刺IPO。它是全球化AGI科技公司,全模态能力领先且成本低。技术上各模态模型表现出色,采用“模型即产品”模式获客,财务业绩向好,团队年轻高效。

量子位
新闻资讯7

太卷了!专属Coding的新一代Arena榜单来了,有国产模型登上榜首

模型编程竞争激烈,编码能力提升成军备竞赛。LMArena发布新世代模型编码评估系统Code Arena,国产模型智谱GLM - 4.6登上榜首,其编码能力获认可,彰显国产模型硬核实力。

机器之心
新闻资讯7

厂都在卷千亿模型,这家深圳企业却专啃“最后一公里”

在CITE 2026上,佑泰创始人张希立分享企业战略。佑泰与厂不同,走差异化路径,聚焦算力落地“毛细血管”,产品覆盖多应用方向,还将转型提供完整算力服务,积极布局信创,面对成本压力坚守契约。

芯师爷
算法论文7

1万tokens是检验长文本的新基准,超过后18款模型集体失智

Chroma团队研究发现,将上下文扩展至1万tokens,18款主流模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。

量子位
新闻资讯7

冲击自回归,扩散模型正在改写下一代通用模型范式

Google I/O 2025 开发者会上,Gemini Diffusion 引发关注,它是采用扩散模型的语言模型。此前已有团队探索扩散式 LLM,如斯坦福、上海 AI 实验室等。蚂蚁集团和人推出 LLaDA,后发展出多模态模型,国内团队跻身前列。

机器之心
新闻资讯7

DeepMind佬最新暴论:单体模型穷途末路,未来买的不是模型,是"智能路由"

DeepMind研究员Andrew Trask认为,因Scaling Law对资源需求攀升,AI将成协议而非程序。组合不同厂商模型有优势,当主流榜单同等评分时变革加速,之后人们将买“智能本身”。

AI寒武纪
算法论文8

Nature重磅!清华团队揭秘模型新规律:告别参数内卷,智能密度每3.5个月翻一番

清华和面壁智能团队研究揭示语言模型进化的致密律,指出为获同等智能,模型参数量呈指数级下降,最能力密度约每3.5个月翻一番,还探讨模型压缩、边缘智能等内容。

AIGC开放社区
产品应用7

WAIC最强亮点:非Transformer离线AI模型规模量产,模型商业比我们想得更快

在WAIC上,RockAI推出非Transformer离线AI模型Yan 2.0 Preview,有视觉感知跃升和自主学习能力两提升。该公司走非Transformer路线,着重场景落地,通过“标杆战略”推动产品量产,未来构想构建“群体智能”世界。

AI科技评论