「CPU优先推理」共找到 2239 篇相关文章
GAN之父Ian Goodfellow病后归来,剑指高效世界模型
GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件多模态世界模型最佳路径,该模型可支持长时序任务预测与规划,还探讨构建原因、数据来源等。
MiniMax M2.5发布:硬刚 Claude Opus,一美元包断一小时的生产力
MiniMax M2.5发布,硬刚Claude Opus 4.6,以一美元包断一小时的低价降低AI生产力门槛。它在编程、办公等多场景表现出色,速度快且成本低,背后是RL Scaling等技术支撑。
智谱GLM-OCR,0.9B开源即巅峰,复杂文档精准解析
智谱发布并开源GLM - OCR,以0.9B轻量级参数在多项基准取得SOTA。它解决视觉感知难题,具备视觉编码与语言解码协作架构,还可端侧与高并发部署,成本低,推动文档智能化处理升级。
如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证
大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。
算力不再稀缺?中国AI芯片供给出现反转
过去中国AI产业常焦虑算力不足,如今国产AI芯片进入集中交付阶段,自给率提升。伯恩斯坦测算,国产化率有望从2023年约17%提至2027年约55%。产业进入新阶段,竞争从“拼参数”转向“拼体系”。
语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约
现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。
把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法
Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。
Manus 产品立项初期会议纪要
该文是 Manus 产品立项初期会议纪要,从核心定位到技术架构、用户体验、人机协作等多方面深入探讨,为项目明确战略、技术、产品层面核心原则,开启重新定义智能体之旅。
谷歌智能体发力:增强版Gemini Deep Research和专属API都来了
OpenAI强势更新,谷歌也没闲着。正式发布增强版的Gemini Deep Research,配套推出DeepSearchQA基准测试集,还发布了Interactions API,这不仅是Deep Research升级,还是Gemini生态的大升级。
Soul APP开源了一款高保真播客生成框架,90 分钟对话零崩盘!
Soul APP背后的Soul AI Lab发布开源项目SoulX - Podcast,是高保真推理框架,能生成90分钟以上连贯对话,有多方言切换等功能,或重塑语音内容产业生产方式。