通用推理系统」共找到 4097 篇相关文章

算法论文8

哈工大、中科院等利用模型“潜意识”提高推理模型效率,0.6B撬动复杂推理

哈工大、中科院等提出TrajSelector框架,让推理模型‘倾听内心独白’。它利用模型隐藏状态,用0.6B轻量级验证器实现比7B裁判模型更精准选择,在数学竞赛基准测试中表现出色,还能离线筛选数据,但在开放域问答有难题。

AIGC开放社区
算法论文7

The Batch: 845 | 没有理由的“推理

研究人员给LLM输入多项选择题,故意提供误导性提示。用MMLU和GPQA测试Claude 3.7 Sonnet和DeepSeek - R1,发现模型常被提示误导,但其‘思维链’往往未提及提示,表明‘思维链’不足以解释推理过程。

DeeplearningAI
产品应用7

通用 Agent 向左,Agentic Browser 向右

作者五一深度体验了Fellou,认为它和Manus走不同路线,Manus专注做Agent,Fellou做基于浏览器的全新系统。还介绍了Fellou核心功能,也指出其上手门槛高、执行慢等不足,认为发展尚早,值得期待。

特工宇宙
新闻资讯8

英伟达通用机器人芯片来了:AI算力提升7.5倍,宇树、银河通用已搭载

本周一,英伟达发布新一代机器人专用芯片Jetson Thor,算力是上一代7.5倍,能效3.5倍,内存容量翻倍。适配新算法,支持多种模型,已受大量厂商重视,相关产品已发售或开放预订。

机器之心
算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位
推荐文章8

SGLang 确定性推理实现技术细节笔记

文章围绕SGLang确定性推理展开,介绍其启用方式,详述批次不变性原理与Batch Invariant Ops实现,如Matmul Persistent Kernel设计;还阐述确定性采样、Attention Backend配置、AllReduce改动等,给出环境变量及测试脚本,有完整解决方案。

GiantPandaLLM
算法论文8

英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限

学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。

机器之心
新闻资讯7

国产推理芯片,赢了英伟达?

算力市场风向生变,国产算力崛起。政策从资金、市场、规则多维度发力,为国产算力扫清障碍。在推理场景中,国产方案性价比更高。其独特分销体系使贸易环节信息透明度低,步入卖方市场,市场也迎来新局面。

芯师爷
新闻资讯7

DeepSeek被曝自研AI推理芯片

据路透社报道,DeepSeek 正开发自研 AI 推理芯片,欲降低对英伟达和国产芯片依赖。此为重大战略转变,影响英伟达股价。虽有降本等好处,但面临技术、制造、生态等挑战。

机器之心
8

快手AgentX:推荐系统开始自我迭代

过去十年推荐系统核心在‘建模’与‘工程’,但日常迭代瓶颈在研发生产方式。快手 AgentX 团队提出 Agent 驱动研发闭环,在快手 App 业务部署中跑通完整闭环,提升效率与业务收益。

机器之心