训练策略」共找到 2783 篇相关文章

新闻资讯7

聊聊腾讯 AI 的「松弛感」

文章通过播客内容探讨腾讯AI现状、大厂进击及2025年AI行业趋势。指出腾讯AI存在感弱与策略有关,其以连接器战略拓展;今年场景和用户体验优先级提高,大厂有内部提效等隐形壁垒。

刘言飞语
开源动态8

没想到,32B清华DeepDive掀翻深度搜索全场的!

文章指出大模型在真实深网搜索场景表现不佳,核心矛盾是缺‘难搜’数据和多轮工具调用 RL。清华 DeepDive 用数据合成造‘难搜’题,端到端多轮 RL 训练,在 BrowseComp 刷新开源记录,迁移能力也强。

PaperAgent
算法论文8

AI Agent组团搞事:在你常刷的App里,舆论操纵、电商欺诈正悄然上演

上海交大和上海人工智能实验室研究发现,多Agent系统中AI有群体恶意共谋风险。其开发MultiAgent4Collusion框架模拟作恶,发现去中心化团伙作案效果更好,还能应对现有防御体系。研究为研发防御策略提供工具。

机器之心
新闻资讯7

真急了!AI落后、Siri彻底输给ChatGPT,拯救苹果全靠她?

据彭博报道,苹果今年接触OpenAI前CTO Mira Murati,讨论与Thinking Machines Lab交易意向。苹果收购策略保守,但AI浪潮下自研已落后,它或需收购补足短板,除该实验室,还关注Cohere等小公司。

新智元
新闻资讯8

规模化破局:中国无人驾驶全球突围|甲子光年

在全球新能源与智能交通变革中,中国无人驾驶企业改写竞争逻辑。百度旗下萝卜快跑凭借12年研发,跨越‘用户规模断层’鸿沟,以‘倍速出海’策略在全球出行革命中争夺主动权,其出海模式与技术能力值得关注。

甲子光年
算法论文8

ICML 2026|告别「单线程」思维,智能体进化出了原生的并行推理大脑

北京通用人工智能研究院语言交互实验室提出原生并行推理器NPR,它有「自蒸馏 + 并行强化学习」三阶段训练范式,配套并行推理引擎,让并行推理成模型原生认知能力,还介绍了其具体实现、实验结论等。

机器之心
推荐文章7

智谱公布“降智”的秘密:Scaling不可避免的痛

智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。

量子位
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:大模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
新闻资讯8

马斯克xAI又融了200亿美元!老黄说到做到投了更多

刚开年,马斯克的xAI完成E轮融资,达200亿美元超预期。英伟达和思科等继续支持,其估值预计从500亿涨至2000多亿。还公布《xAI 2025年终总结》,Grok 5正在训练,传闻一季度推出。

量子位
新闻资讯8

医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框

OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。

投资实习所