大模型发布」共找到 10153 篇相关文章

算法论文8

跳出「黑盒」,人刘勇团队最新语言模型理论与机理综述

语言模型工程成功但理论研究滞后,被视为「黑盒」。人刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。

机器之心
新闻资讯8

史上首次!米兰冬奥基于阿里千问打造奥运官方模型

2月5日,国际奥委会主席柯丝蒂·考文垂宣布基于阿里千问打造奥运史上首个官方模型,已在赛务与公众服务双端落地。此外,自动媒体描述系统、AIGC技术等也有应用,阿里云多项技术助力米兰冬奥。

千问Qwen
新闻资讯7

AI模型重塑学习硬件:从工具到伙伴 | 网易有道孟旭

网易有道词典笔产品负责人孟旭在AICon会分享,以有道AI答疑笔为例,阐述智能学习硬件在模型催化下从“学习工具”进化为“智能伙伴”,其发展呈“需求牵引 - 技术支撑 - 体验升级”螺旋路径。

AI前线
新闻资讯8

GPT-5.4发布:OpenAI首个一统模型,简直是龙虾原生

OpenAI发布GPT - 5.4,这是其首个一统模型,将推理、编程等能力融合,且单项性能领先。它在知识工作、计算机使用、编程调试等能力提升,定位AI数字员工,虽单价高但有省钱机制。

量子位
新闻资讯7

3AI服务接连故障:换模型为什么未必能救你?

昨晚,ChatGPT、Claude、Grok 三 AI 服务接连故障,公开信息未明确共同根因。文章指出,很多人把换模型当容灾,却未检查备用方案独立性。还介绍故障时间线、可能原因及应对措施,强调可靠性重要性。

AI Reading Hub
新闻资讯7

医疗模型的中国战局:谁在打,打到哪了

中国医药AI赛道已有三家公司上市,是模型赛道唯一跑通商业化闭环的方向。介绍了各梯队企业情况,分析百川智能技术领先但商业化待证明,还对2026年医药AI赛道给出关键判断。

AI Reading Hub
新闻资讯7

让GPT-4.1「头皮发麻的考试」!OpenAI给模型上强度,AI能赢吗?

OpenAI 公布 MRCR 评测标准数据集,其针对 AI 模型上下文能力进行「奥运会」级别测评。MRCR 提升了测试难度,能揭示 AI 能力边界,推动模型发展,帮助更合理应用技术。GPT4.1 在一些测试中表现出色,未来 AI 能力上限充满可能。

新智元
新闻资讯8

刚刚,阿里CEO吴泳铭发布「ASI宣言」:超级智能才是终局!

阿里巴巴CEO吴泳铭发布「ASI宣言」,认为AGI仅是序章,ASI才是终局。阿里云有两战略路径,通义千问家族模型性能提升,如Qwen3 - Max超越GPT - 5,各模型在不同领域有出色表现。

新智元
推荐文章7

性能最高提升7倍?探究语言模型推理之缓存优化

文章探讨语言模型推理缓存优化技术演进与未来展望,介绍了主流推理框架vLLM、SGLang,分析KV Cache、Paged Attention、Prefix Caching等技术的优化点,还提及LMCache、DeepSeek的缓存技术,最后提到MCP赋能可视化OLAP智能体应用。

阿里云开发者
算法论文7

Meta最新模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent