多模型 Agent」共找到 10765 篇相关文章

算法论文8

清华孙茂松团队 × 深言科技:以解释作为训练信号,让 8B 模型在幻觉检测上反超闭源大模型

大语言模型幻觉问题待解,成本与算力需求攀升。清华孙茂松团队联合深言科技提出FaithLens模型,把幻觉检测提升为整体评估,以解释作为训练信号,8B模型任务上超闭源大模型

AI科技评论
产品应用8

昨晚,云计算一哥打造了一套Agent落地的「金铲子」

亚马逊云科技在纽约峰会推出全新 AgentAI 方案,涵盖开发架构、模型支持及种工具升级。如 AgentCore 改变开发规则,Strands Agents V1.0 降低 Agent 协作门槛,还推出 Kiro 等应用,推动 Agentic AI 落地。

机器之心
算法论文8

字节最新大模型秘籍:只挑能有推理潜力的数据训练!1.3B模型无需标签自动挑选

字节Seed团队发布AttentionInfluence成果,用1.3B模型给7B模型选数据,无需训练和标签。通过比较基础与弱化模型损失差异评估数据影响,在基准测试提升模型性能,还能结合分类器全面提升表现。

量子位
算法论文8

Agent也能蒸馏了!性能超好

模型运行成本高,普通用户用不起。传统小模型模仿大模型解题步骤易出错。论文提出Agent蒸馏,让小模型学会用检索和代码工具,还加首思前缀与自我纠错“外挂”,使小模型性能直逼大模型

深度学习自然语言处理
推荐文章7

Agent 开发,迎来「AI 云原生」时刻

模型时代,交互主体变为 Agent,「AI 云原生」应运而生。它围绕 Agent 重构架构,有全新技术栈。基于火山引擎工具和模型,展示了 Agent 开发的新流程,还做了两个应用案例。

特工宇宙
推荐文章7

Anthropic:怎么才能控制模型的行为,做好Agents?

Anthropic发关于AI Agents博客,围绕如何配置上下文让模型输出期望行为展开。指出上下文是有限资源,有Context Rot现象,介绍了上下文工程概念、构成,还提及即时策略、长时间任务处理方法及实践建议。

探索AGI
产品应用8

Skywork AI | 发布Super Agent,一站式搞定写作、开发、分析与创意内容生成

去年谷歌定义了Agent,如今随着大模型发展其能力升级。Skywork AI推出Super Agent平台,有5个专家AI agent和1个通用AI agent,能生成类型内容且支持溯源。它突破行业瓶颈,还开源相关框架和MCP。

AINLPer
开源动态8

阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型个开放域问答数据集表现显著提升

阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在数据集提升模型性能,小模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。

量子位
开源动态8

模型共享 GPU 内存,Berkeley 开源新工具

GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。

AI工程化
算法论文8

一篇大模型Agentic框架到应用最新综述

这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。

PaperAgent