「推理优化技术」共找到 5270 篇相关文章
跑分第一,推理暴跌!Claude Opus 4.7上线48小时口碑崩了
Claude Opus 4.7发布48小时口碑两极撕裂。官方榜单并列全球第一,但逻辑推理公开测试成绩暴跌,token消耗涨35%,旧接口报错,用户吐槽「更贵、更蠢、更爱顶嘴」,Anthropic虽解释却难平用户怒火。
DeepSeek-R1发布后的100天复现之旅方法总结
DeepSeek团队发布「推理大模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理大模型与普通大模型区别、复现方法、关键发现及未来方向。
Agent Skill 开发者大赛总决赛圆满落幕,共探智能体技术落地新未来
2026年5月22日,Agent Skill开发者大赛总决赛在上海举办,采用双轨模式,38支队伍参赛,覆盖多元场景。大赛由多社区主办、多单位协办,揭晓企业组、高校组特等奖等,推动智能体技术落地。
RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能
普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。
谷歌IMO金牌模型可以用了!推理性能秒了o3、Grok 4
谷歌拿下IMO金牌的模型Gemini 2.5 Deep Think已在Gemini App推出,速度更快、实用性更强。该模型仅对Ultra订阅用户开放,月费约1803元。其推理性能超o3、Grok 4,有迭代开发等优势。
剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了
剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。
国民技术:覆盖机器人多模块,提供MCU+安全+蓝牙全栈芯片解决方案
国民技术是MCU及安全芯片领先企业,其N32H7/4系列MCU为荣耀“元气仔”、越疆Rover X1等机器人提供关键支撑,还广泛应用于工业机器人。此外,公司构建了MCU + 安全 + 无线射频的完整产品矩阵。
特斯拉世界模拟器亮相ICCV!VP亲自解密端到端自动驾驶技术路线
特斯拉世界模拟器在ICCV亮相,可生成自动驾驶挑战场景,对具身智能也有用。其自动驾驶副总裁Ashok Elluswamy称端到端AI是未来,还揭秘技术细节,特斯拉也在解决端到端面临的难题。业界对端到端路线有VLA和世界模型之争。
OpenAI推理第一人创业了:要造“活到老学到老”的AI,先来融它70个亿
OpenAI推理模型第一人Jerry Tworek离职不到一个月就创业,新公司Core Automation计划筹集10亿美元,要做具备「持续学习」能力的新型AI模型,解决主流模型‘训完就上线’、能力固定的问题。
阿里亲身入局具身智能!Qwen内部组团,通义千问技术负责人带队
阿里Qwen团队组建具身智能小分队,由通义千问技术负责人林俊旸带队。外媒称这是阿里最明确的物理AI系统探索,此前阿里已有投资布局,此次是其AI战略关键落点。