上科大」共找到 6378 篇相关文章

产品应用8

比英伟达早,比李飞飞强,晓Kairos原生一体化世界模型定义物理AI新路线

晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四权威具身智能基准全面登顶。

机器之心
推荐文章7

厂设计师到超级一人公司:6000字回顾我和AI的2025

作者回顾2025年,身份从厂设计师变为自由职业者,用AI加持做超级一人公司。自媒体各平台粉丝量增长,开始做视频;社群活动帮创业者和会员;创作涵盖Vibe Coding、Agent、图像视频等;还介绍合作产品,展望2026年AI趋势。

歸藏的AI工具箱
算法论文8

模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”

近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答模型能否感知问题难度等问题。研究基于数据集在主流 LLM 训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。

深度学习自然语言处理
算法论文8

腾讯发布模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!

腾讯为破解模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM实现端到端加速2.5倍,还能缩短思维链长度。

腾讯技术工程
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示模型RL新机制

中国学院自动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务性能显著优于传统算法。

深度学习自然语言处理
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示模型RL新机制

中国学院自动化研究所、腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务性能显著优于传统算法。

深度学习自然语言处理
开源动态8

智谱终于发布GLM-4.5技术报告,从预训练到后训练,细节公开

个月底智谱开源 GLM-4.5 及轻量版,成绩亮眼引热议。现其技术报告发布,详述预训练到后训练细节,还介绍了开源 RL 框架 slime,展示模型架构、训练阶段等,评估了在多任务的表现。

机器之心
产品应用7

AI看病成为医患新包袱?补「多轮追问」,通用AI才迈得过医疗关

如今患者依赖AI问诊加重医患沟通负担。百川智能推出的Baichuan - M4对通用模型做结构性重构与医疗专项增强。M4在能力结构升级,其C端产品百小医能与患者深度建联,有望构建医疗健康新生态。

量子位
新闻资讯7

王田苗三问具身牛:模型还在「拨号网」,机器人靠什么拿下真实订单?| WRC 2026

在2026世界机器人会的圆桌论坛,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。

AI科技评论
算法论文8

模型基于「图像事实」说话:用事实文本+自适应编辑,让语言偏见无处遁形丨ICLR'26

多模态模型看图常“脑补”,存在对象幻觉问题。北航团队提出AFTER框架,含FAS和QAO模块,能在主流LVLM和基准显著降低幻觉,且推理开销低,为多模态助手落地提供实用路径。

量子位