任务级奖励」共找到 2935 篇相关文章

开源动态8

字节推出X-Streamer,实时口型同步与长程记忆数字人框架

字节推出端到端多模态人类世界建模框架X - Streamer,能从单张人像构建可无限流式生成的数字人,实现音素口型同步和长程记忆。其核心是“思考者–行动者”双Transformer架构,在两张A100 GPU上可实时运行。

带你学AI
新闻资讯7

说一个反常识的真相,Agent如今在真实工作场景的成功率依然很低。

作者有感于AI在真实工作场景评测的稀缺性,以阿里国际站RealReplicaBench评测集为例,介绍电商场景任务,发现多数模型成功率低,其他领域类似,呼吁厂商努力,作者也计划自跑评测更新排名。

数字生命卡兹克
算法论文8

终结多智能体视觉幻觉“滚雪球”!新国立等提出ViF:无需改造模型,即插即用

多智能体协同做视觉任务常轮次越多错得越离谱,根源是信息传递方式有缺陷。新国立等研究人员提出轻量通用的ViF范式,无需改造基座模型,可大幅压制幻觉滚雪球,已入选ICLR 2026。

量子位
算法论文8

中山大学HCP Lab联合拓元智慧提出高效世界模型DDP-WM,机器人规划效率提升9倍

中山大学人机物智能融合实验室联合拓元智慧提出新型高效世界模型框架DDP - WM。它解耦动态预测,在提升推理速度同时,提高规划成功率,如Push - T任务规划速度提9倍、成功率从90%升至98%。

机器之心
产品应用8

美团悄悄上线的AI浏览器Tabbit,我觉得它更适合普通人。

美团光年之外团队发布AI浏览器Tabbit,作者认为它比Comet的Agent能力更强,产品完整细节好还免费。与类OpenClaw产品是互补关系,能处理场景式任务,还有很多实用功能,值得一试。

数字生命卡兹克
开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒

清华大学等联合研发的 AgentCPM-Explore 智能体模型,基于 4B 参数在深度探索类任务表现出色,有打破参数壁垒等亮点,还全流程开源,解决小模型性能提升挑战,邀伙伴共建端侧智能体生态。

AIGC开放社区
算法论文8

LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统

加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。

量子位
新闻资讯7

薛定谔亲外孙创业量子计算,老黄早早就成了股东

PsiQuantum由薛定谔外孙参与创办,获10亿美元巨额融资,欲2028年造百万比特量子计算机。其量子比特基于光子,有生产优势,不过纠错能力待验证。公司团队学术背景强,项目多为政府大单。

量子位
开源动态7

LangChain 推出开源异步编码智能体 Open SWE

LangChain发布开源异步编码智能体Open SWE,可在云端处理复杂开发任务,能集成到开发者工作流。它连接GitHub仓库,在沙箱运行,强调人在回路控制,多智能体架构保障代码质量,早期反应褒贬不一。

InfoQ
算法论文8

单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta

普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。

量子位