「小模型推理能力」共找到 9392 篇相关文章
华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小时级预演万卡集群
华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。
刚刚,MiniMax来承包你的桌面了
2026 年 Agent 赛道竞争白热化,市场分化。国产 AI 大模型独角兽 MiniMax 1 月 20 日推出第二代智能体产品 MiniMax Agent 2.0,从产品形态和能力分布深度重构,是‘AI 原生工作台’,实测表现出色。
Reddit一张神图疯传!2年后,你的笔记本就能跑Fable 5
r/LocalLLaMA社区一张图刷屏AI圈,显示Fable 5级AI预计2年后可在笔记本本地运行。从历史模型看,前沿能力从云端到本地约24个月。这意味着AI正从云端垄断走向桌面民主化。
GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道
OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。
训练MoE足足提速70%!华为只用了3招
Scaling Law下,MoE成扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载不均等问题,使训练吞吐提升72.6%。
Vibe Coding 再升级,做世界顶尖的 Agentic Engineering!
过去18个月,AI Coding工具从‘辅助补全’到‘独立编程’质变,决定Agent产出质量核心变量从模型能力转向工程系统。文章探讨工程师角色迁移、Context Engineering、对抗Agent缺陷、长期维护及发展路径等问题。
谷歌翻译重大更新:实时翻译,全球无障碍交流摩擦苹果
Google搜索产品副总裁宣布Google翻译引入Gemini模型,翻译能力飞跃。更新含顶尖文本翻译、实时语音对话翻译(Beta版)及扩展语言练习功能,适用多平台多语言,谷歌期待用户反馈以优化体验。
2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。
文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。
中国AI创业者重登GTC舞台:杨植麟用技术语言讲了一个智能上限突破的浪漫故事|甲子光年
美国当地时间3月17日,月之暗面(Kimi)创始人杨植麟在英伟达GTC演讲,介绍Kimi技术路线图。他提出开源模型要出色,给出Token效率、长上下文、智能体集群三个概念,还探索了未来架构,且将创新开源。
AI打假AI,拿下SOTA丨厦大&腾讯优图
厦门大学联合腾讯优图实验室团队提出AIGI - Holmes方法,创新性采用“大模型+视觉专家”协同架构,解决现有AIGI检测技术瓶颈,在检测、解释能力及鲁棒性评估上均取得最优效果。