大模型发布潮」共找到 10153 篇相关文章

新闻资讯8

腾讯调整模型组织架构:姚顺雨加盟,向总裁刘炽平汇报

腾讯宣布模型组织架构调整,姚顺雨加盟。他是模型Agent方向青年研究者,将任“CEO/总裁办公室”首席AI科学家等职。腾讯强化研发体系,混元模型成果多,AI产品有竞争力,内部推进AI变革。

量子位
算法论文8

不靠英伟达,中科院在国产 GPU 上跑通 76B 类脑模型

过去模型依赖Transformer和NVIDIA GPU体系,硬件自主化难。中科院团队提出类脑模型SpikingBrain,在超长文本处理上百倍加速,在国产MetaX GPU平台稳定训练76B模型,开辟新道路。

AI科技评论
开源动态8

杨植麟被梁文锋叫醒了!Kimi新模型发布即开源,1T参数全线SOTA

172天后,Kimi推出全新Kimi K2基础模型回应DeepSeek冲击。它为MoE架构,1T参数,激活参数32B,在多任务上领先,发布即开源,还分享技术细节,实测有亮点也待优化,展现回归之势。

量子位
新闻资讯7

模型的价格战,打到硅谷了

今年夏天,AI价格战风向改变,OpenAI酝酿降价从Anthropic抢客户。7月,Anthropic推半价平替Claude Opus 5,此前OpenAI发布GPT - 5.6打性价比。价格战因模型购买逻辑变化、头部差距难支撑溢价等引发,虽让应用层受益,但对模型公司是资本耐力赛。

芯师爷
开源动态7

不可思议!400B模型在iPhone上跑起来了

一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上模型交互级速度运行。

机器之心
开源动态7

阿里达摩院开源多模态医学模型—灵枢

模型在医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三难题。阿里达摩院开源统一多模态医学模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。

AIGC开放社区
算法论文8

模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026

生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。

InfoQ
开源动态8

阿里通义开源「推理+搜索」预训练新框架:小模型媲美模型,多个开放域问答数据集表现显著提升

阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美模型,还验证了训练方式、策略及奖励函数的效果。

量子位
开源动态8

清华团队开源发布首个结构化数据通用模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用模型。它融合结构因果推断与预训练技术,适配多任务,性能超最优专用模型,已落地多个工业场景。

AI科技评论
新闻资讯7

对话地平线前高管牛建伟:万亿参数模型如何重塑具身智能

具身智能赛道分“VLA派”“智驾降维派”和“模型派”。地平线前高管牛建伟认为VLA是弯路,主张用分层架构,以万亿参数“空间智能模型”做脑,VA小模型执行操作,目标是做物理世界的OpenClaw。

AI科技评论