「溯因推理」共找到 3196 篇相关文章
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
拿下五角大楼大单后,OpenAI被曝开始向北约推销军事化AI
刚拿下五角大楼大单,OpenAI 转头向北约推销军事化 AI。其 CEO 奥特曼称要覆盖北约「所有机密网络」,后解释为「非机密网络」。Anthropic 因坚守安全红线被国防部出局,OpenAI 却拥抱军工,其「护栏工程学」难控风险。
社区供稿丨Ring-2.5-1T,思更深,行更远
今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。
互联网已死,Agent 永生
文章指出互联网时代诸多概念如DAU、SaaS等已过时,因旧前提‘人是软件用户’改变,新前提是‘Agent是软件新主人’。还阐述Agent时代四块基石,如Token是特权、Agent是人口红利等,强调新旧世界差异大。
台积电不相信AI有泡沫
台积电2025年四季度财报多项指标超预期,2026年资本开支大幅上涨。其3nm制程和先进封装优势明显,产能供不应求。AI算力需求爆发让英伟达成新大客户,预计2026年超苹果,台积电未来营收增长可观。
当前关于 Vibe Engineering 的所有认知都会在 1 个月内严重过时
作者分享 Vibe Engineering 实践体会,指出当前认知很快过时,因 AI 编程工具和模型进步大。还对比了 Opus 4.5、GPT - 5.2 等模型,阐述人在开发各阶段角色,介绍多 Agent 协同实践及未来软件公司组织形态变化。
视频播客不是内容升级,更像是一场分发补偿
文章从创作者视角出发,阐述部分主播需考虑做视频播客的原因。指出媒介融合下“节目”成最大公约数,美国主播因生存需做YouTube,中国播客靠切片传播,专业创作者做视频成本低且杠杆效应大。
知名数学家辞职投身AI创业:老板是00后华人女生
世界级顶尖数学家小野肯辞职,加入学生洪乐潼创办的AI初创公司Axiom。该公司主打AI数学,此前0产品0用户就达3亿美元估值。小野肯曾怀疑AI,后因认识到其潜力而转变想法。
为什么 2025 的基模公司都押注 Interleaved Thinking?
本文探讨 2025 年基模公司押注 Interleaved Thinking 的原因。从大模型迭代说起,介绍其在多模型中的体现,阐述该思维链对 Agent 的重要性,还提及 MiniMax 在推动其成行业标准上的诸多努力及带来的影响。
DeepSeek V3.2爆火,Agentic性能暴涨40%解密
文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。