「推理技术」共找到 4570 篇相关文章
OpenAI推出GPT-5.1小小小小更新!!!
OpenAI推出GPT-5.1,本周向用户陆续推送,付费用户先行。它有两大核心模型,在遵循指令、推理回复及聊天体验上更佳。还有AMA问答活动披露更多细节,此外官方让自定义ChatGPT风格更易。
The Sentient Interface: Art, Technology, and the Expanded Mind
在计算与数据主导的时代,艺术、科学与技术边界渐趋模糊。本次活动汇聚四位从业者,探讨如何将无形元素转化为审美体验,从生态数据到AI叙事,跨越学科探索人机关系与环境依存。
告别盲目卷参数!科大讯飞1024亮出底牌:all in“更懂你”
在模型能力趋同当下,科大讯飞在1024开发者节提出让AI“更懂你”。展示多模态超拟人“小飞老师”和「百变声音复刻」功能,发布星火X1.5大模型,还推出多领域软硬件产品,赋能多行业。
具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据
AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。
我MiniMax,用实习生处理数据,照样屠榜开源大模型
MiniMax M2屠榜开源大模型,引发社区热议。它在注意力机制、数据处理、思考模式上另辟蹊径,公开技术细节。M2团队选Full Attention,雇实习生处理数据,提出交错式思维链策略,强调实用性和泛化能力。
刚刚,Kimi开源新架构,开始押注线性注意力
智能体时代推理计算需求成瓶颈,线性注意力可降复杂度但表达有限。月之暗面开源 Kimi Linear 新架构,结合线性与全注意力,性能和硬件效率出色,引发对线性与全注意力发展方向的思考。
刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次
Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。
AI时代,开发者不能再当 i 人了,「云计算代言人」敬告
亚马逊云科技副总裁 Jeff Barr 时隔 16 年再访中国,对比两个技术时代。他认为 AI 带来创新与挑战,开发者需强大沟通力。还介绍亚马逊云科技工具 Kiro 及新开发模式,预测未来软件开发形态转变。
两招为GraphRAG图谱“提纯”,DEG-RAG效果有点炸~
文章指出传统RAG多跳推理和全局一致性能力受限,Graph - based RAG虽好但图谱噪音大。作者提出Deg - Rag方案,含实体消歧和关系反思两招。实验显示去噪后图谱效果提升,验证“Less is More”理念。
AI点外卖哪家强,美团LongCat团队做了个全面评测
美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。