多模态 Agent 模型」共找到 9590 篇相关文章

开源动态8

RAG终极框架!港大开源RAG-Anything:统一多模态知识图谱

香港大学黄超教授团队发布开源项目RAG - Anything,构建统一多模态知识图谱架构,解决传统RAG技术局限。它能处理多类型异构内容,提供端到端方案,有多种优势及应用模式,还给出部署指南和未来展望。

新智元
产品应用7

一站式智能分析引擎,快速构建企业级数据分析 Agent

在数据驱动的商业环境中,传统数据分析流程有诸多局限。本文介绍基于阿里云实时数仓 Hologres 和阿里云百炼的联合方案,结合 Function AI 平台,可构建企业级数据分析 Agent,实现端到端加速。

阿里云开发者
产品应用8

一行代码,Claude成本直降85%!最强Opus做大脑,Sonnet疯狂搬砖

Anthropic深夜发布Claude「顾问策略」,让Opus 4.6当「顾问」,Sonnet/Haiku当「执行者」,实测性能翻倍、成本降85%。还带来Monitor工具更新,加上此前的Managed Agents等,构建完整Agent平台。

新智元
产品应用8

基于AI大模型的故障诊断与根因分析落地实现

文章围绕基于AI大模型的故障诊断与根因分析展开,介绍项目背景、目标与原理,阐述要解决的运维痛点及技术架构、知识库构建,还提及ReAct模式实现、Dify工作流及ClaudeCode对比,目前根因定位成功率有所提升。

阿里云开发者
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
新闻资讯7

当AI开始过度思考「hey」这个字…

两张对话截图展现语言模型缺陷,用户发简单问候,模型过度分析,从问候语正式程度到表情符号语义权重,这种过度分析让对话不自然,错过人类交流重点。

AI工程化
开源动态8

给你家 AI Agent 装个「长期记忆」,这个开源库一行代码搞定

Memori是开源的LLM记忆引擎/Python库,为聊天机器人等提供统一长期记忆层。它功能亮点多,如自动记忆分类、精准召回等,集成成本低,还有进阶玩法和企业安全能力。

小华同学ai
算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心
开源动态8

HexStrike代理:让大模型继承专家经验,显著提升渗透测试效率

HexStrike是开源渗透测试工具,以MCP为底座。其核心智能组件IntelligentDecisionEngine是专家系统,将安全专家经验规则化,通过知识库和算法提供工具选择和参数优化,提升渗透测试效率。

AI与安全
算法论文8

NIPS2025 | A-Mem让Agent拥有动态自我记忆功能,达到新SoTA

近年来,LLM代理需长期内存系统,但现有系统缺乏灵活性。论文提出A - Mem能动内存系统,受Zettelkasten启发,能让记忆‘自我整理’和‘自我更新’,在多基准测试领先,也指出了局限性和未来方向。

深度学习自然语言处理