企业大模型」共找到 9813 篇相关文章

新闻资讯7

3AI服务接连故障:换模型为什么未必能救你?

昨晚,ChatGPT、Claude、Grok 三 AI 服务接连故障,公开信息未明确共同根因。文章指出,很多人把换模型当容灾,却未检查备用方案独立性。还介绍故障时间线、可能原因及应对措施,强调可靠性重要性。

AI Reading Hub
推荐文章7

企业应用注入AI:架构师需关注的3工程挑战与9种设计模式

文章指出企业常将AI引入现有应用,集成时要考虑系统风险。介绍架构师需关注的3工程挑战及9种设计模式,含可用性、性能、安全增强相关模式,助企业让AI应用从“能用”变“好用”。

AI大模型应用实践
开源动态8

医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗模型正式开源,登顶权威榜单

2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗模型或成最优解,它参数量,在多评测中登顶,技术优势明显。

机器之心
算法论文8

清华首提通用模型滤波方法,实现零样本状态估计|NeurIPS'25

清华学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入语言模型推理框架。它能解决传统方法泛化性差问题,在未见过系统中实现零样本状态估计,有望成基础模型

新智元
新闻资讯7

医疗模型的中国战局:谁在打,打到哪了

中国医药AI赛道已有三家公司上市,是模型赛道唯一跑通商业化闭环的方向。介绍了各梯队企业情况,分析百川智能技术领先但商业化待证明,还对2026年医药AI赛道给出关键判断。

AI Reading Hub
开源动态8

超越GPT-4o和Gemini 2.5!小米MiMo-Audio音频模型真香

小米推出MiMo - Audio模型,预训练数据超1亿小时。它在多个基准测试成开源7B模型SOTA,开放相关资源。分词器表现佳,有全新架构,在音频理解、对话、推理等方面表现出色,还集成TTS功能。

AIGC开放社区
算法论文8

ICLR 2026 | 别再让模型“想太多”了!最新研究揭示 LLM 推理效率的关键瓶颈

语言模型推理计算成本失控,存在过度与思考不足问题。研究揭示推理失衡是根源,提出BAM模型及Plan - and - Budget框架,实验显示其能提升准确率与效率,转向‘推理价值’范式。

机器之心
算法论文8

多模态模型中Attention机制暗藏「骗局」,需用一个公式修正丨上×南开

上海学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。

量子位
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出推理模型性价比新王|开源

MiniMax开源推理模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
算法论文8

ICML 2025 Spotlight | 多模态模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距,视觉推理是核心瓶颈。

机器之心