多模型推理」共找到 10009 篇相关文章

新闻资讯7

反超Gemini 3!马斯克放出Grok4.1快速推理版,还曝出了新一轮150亿美元融资

Grok4.1被Gemini 3反超后,据华尔街日报爆料,xAI正计划150亿美元融资,公司估值将达2300亿美元。xAI成立两年来估值飙升,马斯克还发布Grok 4.1 Fast击败Gemini 3。

量子位
新闻资讯7

比Claude效果更好、且便宜近 100 倍?xAI祭出“白菜价”AI编码模型掀桌子!网友:便宜没好货

xAI 推出编码助手模型 Grok Code Fast 1,采用新架构,有强大全栈开发能力。价格低,在性能与成本间取得平衡。用户评价不一,它在日常开发场景性价比高,与其他竞品各有优势。

InfoQ
开源动态8

0.5B以小搏大拿下端侧模型新SOTA:4090可跑,长文本处理5倍常规加速丨清华&面壁开源

清华大学和面壁智能团队开源MiniCPM 4,有8B、0.5B两种参数规模,以22%训练开销达同级别最优。它在架构、推理、数据、训练方面创新,性能领先,适用于综述生成、工具调用等场景。

量子位
新闻资讯7

Anthropic神话模型发布,但不让你用

Anthropic发布神话模型Claude Mythos Preview却不开放使用,发起玻璃翼计划联合科技巨头用该模型修复全球软件漏洞。此模型能自主发现众零日漏洞,合作伙伴应用后强调跨行业协作应对网络安全挑战。

AIGC开放社区
新闻资讯8

慕了!内存芯片巨头年终奖人均64万;32岁程序员猝死背后公司被扒,曾给39万“封口费”;马斯克曝星舰成本将降99%,商业航天受捧|AI周报

这是一篇AI周报,涵盖领域热点。如SK海力士发高额年终奖;月之暗面张予彤称Kimi用少量资源开发领先模型;马斯克透露星舰目标、人形机器人计划等;家公司有新动态,如阿里推AIGC应用、百川发布医疗大模型等。

AI前线
开源动态8

开源模型终于有了自己的 Opus 时刻

智谱深夜发布的新一代旗舰模型 GLM - 5,此前以匿名模型 Pony Alpha 被开发者热测。2026 年编程大模型风向转变,GLM - 5 参数提升,测试成绩优异,实测能完成复杂工程任务,适配国产算力平台。

AGI Hunt
算法论文8

GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026

本文聚焦基于模型的离线强化学习,指出RAMBO算法存在保守性难控和训练不稳问题。为此提出ROMI方法,引入鲁棒价值感知框架与隐式可微自适应加权机制,在基准任务上超越基线算法。

AI科技评论
开源动态8

腾讯AngelSlim升级,首个集LLM、VLM及语音模态为一体的投机采样训练框架,推理速度飙升1.8倍

随着大模型应用成本与延迟问题凸显,腾讯混元升级 AngelSlim 训练框架,将投机采样技术拓展至全模态场景。它以 Eagle3 架构让推理速度最高飙升 1.9 倍,还具全模态训练、面向部署等亮点,有开源代码。

机器之心
新闻资讯7

微软亚洲研究院机器学习组首席研究员刘炜清确认出席 AICon 深圳,分享由生成式基础模型驱动的金融市场仿真引擎

8月22 - 23日,首届AICon全球人工智能开发与应用大会深圳站将启。微软亚洲研究院刘炜清等专家将分享经验。刘炜清会介绍由生成式基础模型驱动的金融市场仿真引擎MarS,展示其在金融场景潜力。

InfoQ
产品应用8

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT - 5.2 登场,有 Instant、Thinking、Pro 三个版本,在方面大幅升级,能覆盖 44 类专业工作。它经济性强、编程能力佳、推理出色,但存在速度慢的问题,其价格 API 端有调整,未来还将推 Codex 优化版。

AI前线