再思考能力」共找到 3930 篇相关文章

算法论文8

腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型

腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考式学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。

深度学习自然语言处理
新闻资讯7

AI原生产品不等于全部功能AI化,保留传统功能让用户体验更完整 | 对话小卡健康

AI健康管理赛道竞争激烈,产品各有差异。量子位智库访谈小卡健康产品负责人李雅,探讨AI如何赋能、产品功能拓展、数据指标关注、智能设备联动、开发问题及运营推广等,展示其差异化策略和发展思考

量子位
新闻资讯7

先验+后验加持,大模型能否 hold 住推理预测的现实「溢出」?

多数大模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,大模型在现实场景运用仍待优化。

机器之心
新闻资讯7

稚晖君机器人炸场:全球首秀“真男人必会的韦伯斯特空翻”

智元的灵犀X2成全球首个完成韦伯斯特空翻的机器人,该动作对腿部爆发力和协调性要求高。稚晖君介绍其攻克难点的原理,完成此动作验证了硬件可靠性,也体现机器人应对复杂环境的能力

量子位
开源动态8

开放全栈!超越π0,具身智能基础大模型迎来真·开源,开发者狂喜

继π0后,具身智能基座模型WALL - OSS正式开源,多项指标超越π0。它是通用多模态具身模型,具良好推理和泛化能力。背后自变量机器人刚完成近10亿A + 轮融资,开源将降低具身智能门槛。

量子位
产品应用8

AI云的大考来了:企业要的不是参数,而是盈利 | 甲子光年

历经3年大模型热潮,AI云市场提问改变,企业更关注平台模型实用性和故障恢复能力。百度云智大会聚焦新一代智能基础设施与平台升级,其智能云连续六年排名第一,此次升级回应企业落地AI的核心问题。

甲子光年
推荐文章7

初探:从0开始的AI-Agent开发踩坑实录

作者分享从0开始开发AI Agent实现开源应用Helm Chart自动化生成的历程。介绍了定义角色、明确AI能力边界等开发要点,尝试三种Agent范式,还提及实践痛点如AI可观测性不足、Prompt工程困境等。

阿里云开发者
推荐文章8

专访阿里国际站总裁张阔:给AI时代生意人的9条启示。

文章是对阿里国际站总裁张阔的专访,他就AI时代出海生意给出9条启示,如搜索逻辑转向GEO、商家应回归生意本质、把AI当合伙人等,强调商家要适应变革,抓住AI带来的机遇。

数字生命卡兹克
算法论文8

国产AI击败Meta:ReasonRank荣登BRIGHT榜单第一

基于LLM的段落排序方法中,listwise排序虽有优势,但当前重排器难处理复杂推理查询。ReasonRank通过生成推理密集型训练数据及两阶段后训练,赋予listwise重排序器强推理能力,在BRIGHT榜单击败Meta。

CourseAI
开源动态7

OpenAI没开源的gpt-oss基础模型,他去掉强化学习逆转出来了

OpenAI未发布gpt-oss基础模型,Cornell Tech博士生Jack Morris自行逆转gpt-oss模型强化学习,发布gpt-oss-20b-base。该模型可生成任意文本,但不对齐,还测试了其记忆能力,介绍了诞生原理与技术细节。

机器之心