「推理效率」共找到 3022 篇相关文章
光刻机巨头ASML,108亿控股了一家大模型公司
光刻机巨头ASML领投法国AI明星公司Mistral AI的C轮融资,砸13亿欧元成第一大股东,推高其估值至100亿欧元。Mistral开源与商业化并行,ASML投资或提升光刻机效能。
EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式
本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。
“碰一碰”背后:AI智能体正在重构线下流量与商业价值|甲子光年
文章围绕AI智能体重构线下流量与商业价值展开,指出中小商家增长困境,介绍汇智智能“AI+碰一碰”方案,它降低使用门槛,提供一站式智能解决方案,还将推动AI成线下商业新范式。
英伟达再出手!新型混合架构模型问世,两大创新实现53.6倍吞吐提速
英伟达研究者提出新混合架构语言模型 Jet - Nemotron,在达 SOTA 全注意力模型精度时效率卓越,2B 版性能超 Qwen3 等,H100 GPU 上生成吞吐量最高加速 53.6 倍,基于 PostNAS 和 JetBlock 两大创新。
仅靠5000+样本,全新强化学习范式让30B轻松击败671B的DeepSeek V3
传统强化学习在创意写作领域举步维艰,蚂蚁技术研究院联合浙江大学开源全新强化学习范式Rubicon,构建10000+条「评分标尺」,拓展应用至主观任务领域,其30B模型用5000样本超越671B的DeepSeek V3。
波士顿动力Atlas人形机器人再现逆天进化:通用AI机器人真的要来了
波士顿动力为Atlas人形机器人训练全新大型行为模型LBMs,它是语言指令驱动的策略模型,能完成复杂操作任务。构建模型有四步骤,实践遵循三大原则,还展示了其多方面操作能力与特点。
NextStep-1:一次在图像生成上自回归范式的探索
阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现端到端训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。
Cursor or Claude Code ?— 这道题怎么选
文章深度对比Cursor和Claude Code两款AI编程工具,介绍其核心功能、适用场景。经案例分析,指出Cursor快但草率,Claude Code慢却精准。还给出使用心得,建议开发者依任务灵活选择或结合使用。
一个邪修方法,帮你把用Agent的钱省掉80%。
作者曾分享Minimax的Agent,因使用成本高遭读者反馈。现该工具推出Publish to Gallery & Remix功能,用户可复用项目,降低成本,还能形成集体智慧。不过产品和交互设计较粗糙。
刚刚,商汤内部两万字复盘曝光:多模态通往AGI核心路线首次公开
商汤科技联合创始人林达华撰写万字长文,剖析将「多模态通用智能」视为技术战略核心引擎的原因,探索组织及战略层面的思考。文章回顾商汤多模态之路,探讨多模态通向AGI的原因、构建路径等关键问题。