「推理模式」共找到 2850 篇相关文章
一年后,DeepSeek-R1的每token成本降到了原来的1/32
几天前,DeepSeek更新R1论文至86页,公开训练全路径等细节。英伟达发表博客展示在Blackwell GPU上对其降本增效,通过软硬协同提升每瓦特Token吞吐量,还介绍了TensorRT - LLM软件及相关技术提升性能的情况。
“最悲伤的结局”?IBM豪掷110亿收购Confluent:Kafka开源焦虑升级,Flink流计算成最大赢家
IBM 以 110 亿美元全现金收购 Kafka 公司 Confluent,此前已在开源软件收购投入超 500 亿美元。Confluent 贡献 Kafka 超 60 - 70% 代码量,收购引发开源社区担忧,也让 Flink 流计算或成赢家。
OpenAI内部代码泄露!最强模型「皇帝」登基,0思考延时吓人
OpenAI代码泄露,神秘的「企鹅家族」模型在测试,代号Emperor的推理预算最高。同时,ChatGPT将推「记忆搜索」功能。此前谷歌Gemini 3抢份额,OpenAI或提速发布GPT - 5.2抗压。
奥特曼怕了!GPT-5.5「大蒜」决战谷歌,红色警报紧急拉响
三年前ChatGPT让谷歌恐惧,如今OpenAI被谷歌逼得拉响‘红色警报’。OpenAI计划发布新推理模型,‘Garlic’预训练有突破,还启动下一代模型。OpenAI调整策略,聚焦提升ChatGPT体验。
美团LongCat扎扎实实做了件难事:LLM数学新天花板AMO-Bench
美团LongCat团队联合高校推出AMO - Bench,用50道原创奥赛级难题评估LLM数学能力。它解决现有基准测试痛点,经四重把关构建,测试显示顶级模型表现不佳,也揭示模型提升空间大。
成本仅0.3美元,耗时26分钟!CudaForge:颠覆性低成本CUDA优化框架
CUDA代码性能对模型训练与推理重要,但手动优化门槛高。明尼苏达大学团队提出CudaForge,是低成本多智能体CUDA Kernel生成与优化工作流,实验效果好,成本低且具通用性。
创新中心 | 2025首届“幻镜”AI视听测评季成果在京发布,探索AI视听领域建立科学测评体系
2025年10月28日,“人工智能赋能精品创作沙龙”暨首届“幻镜”AI视听测评季成果发布会在京举办,活动旨在为AI视听领域建科学测评体系。会上公布测评结果、优秀作品片单,发布研究分析报告。
联手诺基亚入局6G,老黄要制定全球标准!GTC最新演讲揭秘:「美国科技的未来」就靠这6张王牌
老黄在华盛顿 GTC 大会演讲,英伟达要和诺基亚合作干 6G,重新构筑世界通信系统。演讲涉及 6 大核心,包括利用物理人工智能和数字孪生技术重塑美国工业化等,还介绍了加速计算、AI 变革等多方面内容。
Talos Linux:为 Kubernetes 操作带来不可变性和安全性
Sidero Labs开发了专为运行Kubernetes的不可变操作系统Talos Linux及集群生命周期管理平台Omni。InfoQ采访Sidero团队,探讨其以极简和安全优先理念简化Kubernetes操作,还谈及产品战略、应用场景等。
红色警报:OpenAI的Atlas浏览器,是捅向谷歌万亿心脏的匕首吗?
OpenAI推出ChatGPT Atlas浏览器,争夺全球互联网入口,直指谷歌核心业务命脉。谷歌核心收入源于搜索广告,Chrome是确保流量的关键。而Atlas以‘回答’和‘执行’为核心,或让谷歌广告竞价系统失效,谷歌必将强力反击。