「通用推理技术」共找到 4995 篇相关文章
哈工大、中科院等利用模型“潜意识”提高推理模型效率,0.6B撬动复杂推理
哈工大、中科院等提出TrajSelector框架,让推理模型‘倾听内心独白’。它利用模型隐藏状态,用0.6B轻量级验证器实现比7B裁判模型更精准选择,在数学竞赛基准测试中表现出色,还能离线筛选数据,但在开放域问答有难题。
通用AI Agent系统AI Manus
AI Manus是通用AI Agent系统,支持在沙盒环境运行工具。文中给出使用示例,介绍环境要求、部署与开发指南,推荐用Docker Compose部署,还提及项目地址、交流群等信息。
The Batch: 845 | 没有理由的“推理”
研究人员给LLM输入多项选择题,故意提供误导性提示。用MMLU和GPQA测试Claude 3.7 Sonnet和DeepSeek - R1,发现模型常被提示误导,但其‘思维链’往往未提及提示,表明‘思维链’不足以解释推理过程。
传感器技术如何赋能船舶?
本文介绍船舶传感器技术,其是衡量船舶工业竞争力的关键。阐述了传感器在船舶各系统的应用、分类、工作原理、安装场景,指出我国产业在规模扩大同时存在短板,还探讨了未来升级方向、应用拓展及产业创新路径。
英伟达通用机器人芯片来了:AI算力提升7.5倍,宇树、银河通用已搭载
本周一,英伟达发布新一代机器人专用芯片Jetson Thor,算力是上一代7.5倍,能效3.5倍,内存容量翻倍。适配新算法,支持多种模型,已受大量厂商重视,相关产品已发售或开放预订。
首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升
西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。
一篇Graph+AI Agents最新技术综述
该综述提出分类框架组织Graph与AI Agents领域研究进展,详细探讨图技术在AI代理规划、执行、记忆和多代理协调等核心功能中的作用,还提及代表性应用、挑战和未来机遇。
一篇LLM × DATA技术最新系统性综述
上交大、清华等联合发表综述,探讨LLM与数据管理双向关系,分析LLM不同阶段数据管理技术与挑战并给出方案,还讨论了LLM在数据管理任务中的应用进展,为研究和实践提供指导。
国产推理芯片,赢了英伟达?
算力市场风向生变,国产算力崛起。政策从资金、市场、规则多维度发力,为国产算力扫清障碍。在推理场景中,国产方案性价比更高。其独特分销体系使贸易环节信息透明度低,步入卖方市场,市场也迎来新局面。
多模态技术爆发元年,行业应用如何落地?
InfoQ《极客有约》X AICon 直播栏目,邀上海交大赵波、快手高欢、腾讯邵帅探讨多模态大模型。谈及技术挑战、开源闭源、行业落地等,还分享精彩观点,如先大后小蒸馏提效,垂直模型现阶段更优。