「溯因推理」共找到 3190 篇相关文章
刚刚,Kimi开源新架构,开始押注线性注意力
智能体时代推理计算需求成瓶颈,线性注意力可降复杂度但表达有限。月之暗面开源 Kimi Linear 新架构,结合线性与全注意力,性能和硬件效率出色,引发对线性与全注意力发展方向的思考。
刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次
Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。
奥特曼考虑给ChatGPT加广告了!用8亿用户,救万亿债务
OpenAI凭ChatGPT有8亿周活与约130亿美元年收入,因订阅难覆盖成本考虑加广告,还获软银巨额投资,豪赌算力扩张;Anthropic低调攻企业,Claude在专业领域强,收入逼近OpenAI一半,打法稳健。
两招为GraphRAG图谱“提纯”,DEG-RAG效果有点炸~
文章指出传统RAG多跳推理和全局一致性能力受限,Graph - based RAG虽好但图谱噪音大。作者提出Deg - Rag方案,含实体消歧和关系反思两招。实验显示去噪后图谱效果提升,验证“Less is More”理念。
AI点外卖哪家强,美团LongCat团队做了个全面评测
美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。
Andrej Karpathy最新万字采访:AGI还需10年,RL其实很糟糕,AGI不会导致经济大爆发
Andrej Karpathy在两小时万字采访里阐述AI观点。他认为AGI还需十年,强化学习糟糕,其不会带来经济爆炸式增长。还分享创办Eureka的愿景,想构建“知识斜坡”,让人类在AI时代有更强认知力。
谷歌 DeepMind 推出 CodeMender:自动修复代码的智能代理
谷歌DeepMind推出CodeMender,这一AI驱动的智能代理能自动检测、修复并加固软件漏洞。它结合多种技术推理程序行为,生成修复方案经自动测试和人工审核后提交。社区反响积极,长期影响待察。
一篇大模型Agentic框架到应用最新综述
这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。
云栖大会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!
云栖大会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。
「AI大模型时代的CIO」云栖专场: AI实战者与落地破局者的坦白局
云栖大会「AI大模型时代的CIO」专场,探讨企业AI落地难题。虽搭上AI电梯是趋势,但企业落地有不确定性,如组织架构不匹配等。多位实战者分享经验,给出RIDE等解法,助企业破局。