溯因推理」共找到 3190 篇相关文章

开源动态8

清华团队:1.5B 模型新基线!用「最笨」的 RL 配方达到顶尖性能

清华团队用两个 1.5B 模型证明,用最基础的 RL 配方可达到小模型数学推理能力 SOTA。单阶段训练加固定超参数实现 SOTA 性能且省一半算力,训练曲线还很平滑。

机器之心
新闻资讯7

别装了!你不是恋爱脑,而是被AI洗脑

Perplexity CEO Aravind Srinivas警告AI陪伴应用太拟人、危险,可能让人沉溺虚拟世界。但全球已有上千万用户使用,AI填补情感空缺,满足人们对回应的需求,让孤独可被诉说。

新智元
新闻资讯8

OpenAI 终于意识到,单靠微软,实现不了AGI

11月3日,OpenAI与亚马逊云科技达成约380亿美元合作。此前其与微软关系生变,新协议降低微软持股、取消优先购买权。OpenAI预计需1.4万亿美元构建计算设施,重组后或2026年上市。

InfoQ
开源动态8

国产模型新盛况!王座易主:Kimi K2 Thinking开源超闭源

月之暗面开源 Kimi K2 Thinking 模型,多方面性能超 GPT - 5 等闭源模型。它擅长多轮调用工具和持续思考,在多项基准测试达 SOTA 水平,成本低且授权宽松,引发全网讨论。

机器之心
开源动态8

离GPT-5最近的一次!中国1万亿参数开源巨兽突然爆火

月之暗面发布全新模型Kimi K2 Thinking,自称开源「思考Agent模型」。它参数约1万亿,性能亮眼,碾压GPT - 5等,能连续调200 - 300次工具,已上线并开源API和权重,开发者可试用。

新智元
算法论文8

内存直降50%,token需求少56%!用视觉方式处理长文本

在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。

新智元
新闻资讯8

MiniMax M2 发布即爆,拿下开源模型第一名

10月27日,MiniMax发布新一代文本大模型M2及由其驱动的MiniMax Agent。M2是专家混合模型,参数达230B但激活仅10B。它在开源模型评测中夺冠,能低成本、高速度支撑工作流,开发者评价高。

MacTalk
新闻资讯7

一场火,让公众对动力电池安全的信任“倒退十年”|甲子光年

理想MEGA起火事故引发公众对新能源车动力电池安全的讨论。该车搭载麒麟电池,材料体系为三元锂。从技术角度分析,可能与电池材料体系、三元锂电池正极材料摩尔比及被忽视的气凝胶防护措施有关。

甲子光年
开源动态7

SGLang Model Gateway 0.2 发布:企业级一体化AI原生编排

市面上一体化AI原生编排方案稀缺,Oracle和SGLang团队推出SGLang Model Gateway 0.2。它从SGL - Router重构而来,核心能力升级,架构分三层,部署灵活,还支持Kubernetes集成和向后兼容。

AI工程化
产品应用7

Claude Skills很重要

作者本想退订Claude,Anthropic发布Claude Skills改变主意。它是‘能力包’,含SOP、工具和资源,分层加载省上下文窗口。预设Skills可体验,官方开源,模块化设计利于挂载和按需加载,或形成Skills Market。

newtype AI