生成式强化学习」共找到 3479 篇相关文章

产品应用7

干掉 90% 的 BI 工程师:自动生成 SQL、洞察、预测,连图表都帮你画好

介绍了基于LLM和RAG的结构化数据问答系统,它能将查询转化为SQL语句执行,生成数据图表及分析。其看板用法新颖,可进一步分析、预测,免去大部分BI工作,对非技术分析人员友好。

CourseAI
算法论文8

高效智能体的「幕后推手」是谁?一篇综述带你从记忆×工具学习×规划看透

随着大模型能力提升,业界关注智能体落地,而高效性是决定能否上线的‘硬’问题。论文梳理‘高效智能体’综述,从记忆、工具学习、规划三机制出发,还谈及基准评测、挑战与展望。

机器之心
算法论文8

王兴兴署名,宇树机器人春晚之后又进化了:单个策略就能学习各种极限动作

春晚上,宇树机器人展现高动态、高协同的全自主集群控制技术。现在,多机构提出 OmniXtreme 通用策略,可执行各种极限动作。该框架分两阶段,经测试在仿真和现实中表现出色,打破了泛化壁垒。

机器之心
新闻资讯7

红杉的投资哲学和秘密武器,a16z 投了个很有意思的 AI 学习产品

文章分享红杉投资哲学与秘密武器。决策重信念而非共识,管理赋能‘异类’人才,聚焦可控‘输入’,筛选要有勇气。还提到其‘人才佩奇排名’系统,此外介绍a16z投资的AI学习产品。

投资实习所
推荐文章7

AI 一键生成网站之后,最残酷的差距出现了:代码不再值钱,审美决定生死

知名前端开发者 Wes Bos 认为,2026 年将是“设计复兴之年”。当 AI 能让任何人快速生成网站,真正的差异化将来自审美、取舍和打造独特体验的能力。如 Lando Norris 官网,靠精心设计吸引关注。

InfoQ
算法论文8

抛弃预定义Tool,首次提出通过动态工具生成的Agentic多模态Reasoning,破31%涨幅

视觉推理任务中,传统多模态大模型依赖预定义工具,灵活性与领域适应性差。PyVision 框架首次让 MLLM 在推理中实时生成、执行并迭代 Python 工具,在多类任务中显著提升性能,实现范式跃迁。

深度学习自然语言处理
算法论文8

首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26

研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。

新智元
新闻资讯7

Zig 创始人直言,Bun 靠 Claude 生成的 Rust 重构版是“没人把关的烂代码”

Bun创建者用Claude智能体11天将Bun从Zig移植到Rust,虽通过测试,但Zig创始人Andrew Kelley批评其编程实践不规范,认为代码是‘没人把关的烂代码’,且AI生成代码缺监督会出问题。

InfoQ
算法论文8

让Agent画思维导图稳固长期记忆:新框架实现稳定长期学习,准确率提升38%

中国电信人工智能研究院研究团队提出TeleMem框架,从数据结构层重新设计Agent记忆组织方式,使记忆可检索、累积、回溯和演化。该框架解决了传统RAG在长期记忆管理和持续学习方面的瓶颈,准确率提升38%。

量子位
算法论文8

ICLR 2026|在「想象」中进化的机器人:港科大×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习

香港科技大学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 新范式,可让具身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。

机器之心