多步决策」共找到 4383 篇相关文章

开源动态8

不安全指令,一拒了之?TRIAD用三路决策:修复AI智能体的危险计划

墨尔本大学团队开源TRIAD框架,将传统二元护栏决策扩展为继续、更新、拒绝三类。通过自然语言反馈引导Agent修正计划,在ASB和AgentHarm评测中,显著降低攻击成功率,提升正常任务完成率。

新智元
产品应用8

打开高德的理由又一条!全球首个「需求链智能调度」AI地图上线

8月,全球首个AI原生地图应用——高德地图2025上线。它有「需求链智能调度」系统,能处理任务出行。其ST - MAC技术可解构复杂请求、构建群体智能服务生态,还有时空感知、AI探索等功能。

新智元
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face
算法论文8

AI 如何讲好一个人故事?首个支持角色互动的3D场景叙事系统

首尔国立大学提出全新框架,能生成虚拟动态场景并支持角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性和实用性。

带你学AI
产品应用8

首个真正“能用”的LLM游戏Agent诞生!可实时高频决策,思维链还全程可见

超参数科技推出全新游戏智能体COTA,它由大模型原生驱动,操作似职业选手,决策如教练,推理链路清晰。在自研FPS游戏Demo中表现出色,还打破‘不可能三角’,有望重构游戏人机关系。

量子位
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向智能体系统的失败归因

随着大语言模型发展,智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

深度学习自然语言处理
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向智能体系统的失败归因

随着大语言模型发展,智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

PaperAgent
算法论文7

AIAAJ | 西工大张巧、张伟伟等:专家特征融合网络架构预测跨声速抖振气动噪声

为解决气动噪声数据中流动状态与空间位置分布不平衡导致的MLP预测精度不足问题,本研究提出专家特征融合网络架构,以跨声速抖振气动噪声为算例评估,可降低MLP算法MSE,泛化性更好。

力学与人工智能
算法论文8

NeurIPS 2025 | 北大联合小红书提出Uni-Instruct:ImageNet单生图FID进入1.0时代!

北大联合小红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种单扩散模型蒸馏方法,在项任务达最佳性能,还能用于文本到 3D 生成。

机器之心
推荐文章7

取消AI考核、零裁员!股价暴跌82%后,邻国走出了一条反硅谷之路

邻国曾是AI转型标杆,后股价暴跌82%。其联合创始人兼CEO Luis von Ahn在访谈中称未裁员,还分享公司用AI情况,如取消AI考核、员工用AI做课程等,也谈到了AI局限和各职业前景。

InfoQ