推理时计算」共找到 2167 篇相关文章

产品应用8

文心新出的推理大模型,给了我们信心

在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心
算法论文7

无需外部数据!AI自问自答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。

量子位
新闻资讯7

4000亿国产力航母:芯片巨头合并超巨头

上交所披露海光信息拟换股吸收合并中科曙光并募资,两家公司A股自5月26日开市起停牌,预计不超10个交易日。海光聚焦芯片研发,中科曙光深耕服务器领域,重组方案待明确,实施有不确定性。

量子位
算法论文8

不上AGI,但Anthropic发现了Claude的潜意识!

Anthropic可解释性团队新论文在Claude内找到“意识”与“潜意识”分水岭。用J - lens读取模型“想法”,经五组实验验证其类似人类“意识通达”结构,还涉及安全审计、反事实反思训练等内容。

花叔
推荐文章7

AI抹平了执行力,一个人的价值该重新怎么

AI 把执行成本压到近乎零,让公司原有的评估制度失灵,出现领导不会下需求、执行力无区分度、产出不稳定等症状。旧体系重执行流量,AI 时代更看重判断势能,组织、管理者和个人都需重新校准。

AI Reading Hub
推荐文章8

构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理

企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。

InfoQ
算法论文8

谷歌的DeepSeek时刻:LLM推理加速被干到了8倍

谷歌TurboQuant论文介绍量化法,能为大语言模型和向量搜索引擎大规模压缩。可将大语言模型KV缓存内存减至少6倍、加速达8倍且精度零损失,还介绍其工作原理及实验结果。

PaperAgent
算法论文8

AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!

中国人民大学与快手团队联合提出 AEPO 法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流法,在 X 等平台获高关注。

机器之心
算法论文8

模仿学习新范式!Chain-of-Action:轨迹自回归实现动作推理

具身智能领域尚未迎来「GPT时刻」,现有模仿学习范式有缺陷。字节跳动与阿德莱德大学研究者提出「动作链」(CoA)策略,通过轨迹自回归建模解决累计误差,提升泛化性,实验效果显著。

机器之心
新闻资讯7

告别传统存分离,AI时代数据底座迎来全新底层逻辑

文章围绕AI时代数据底座变革展开。指出传统大数据平台难适配AI,存在数据够不着、模型用不好等问题。阐述AI时代基础设施变化,如数据形态、计模式等。还探讨底座升级条件、存储挑战、子价值及未来标准层等内容。

AI前线