大模型Agent」共找到 10509 篇相关文章

算法论文8

都说记忆是Agent标配,但MemSyco发现漏算了一件事

厦门学与吉林学的最新研究指出,随着大模型Agent具备长期记忆,虽成为“长期协作者”,但也出现Memory-Induced Sycophancy问题。为此提出MemSyco - Bench评测基准,经实验得出多项发现,指出Agent Memory关键瓶颈转变。

PaperAgent
开源动态8

蚂蚁再把医疗AI卷出新高度!蚂蚁·安诊儿医疗模型开源即SOTA

蚂蚁集团联合多方开源的医疗模型蚂蚁·安诊儿(AntAngelMed),一经发布就登顶多项医疗基准测试榜单,是迄今参数规模最的开源医疗模型,应用门槛低,为行业示范出一条清晰路径。

量子位
新闻资讯8

AI 的下一个战场:端侧模型崛起

模型退烧,小模型接棒。腾讯、阿里等厂纷纷官宣小模型成果,英伟达、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不低,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。

AI科技评论
算法论文8

复旦、同济和港中文等重磅发布:强化学习在语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三贡献。

机器之心
开源动态8

断网可用!首款全双工全模态模型技术报告发布,附一键安装包

面壁智能等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧安装包等,低显存GPU即可运行,性能表现优秀,应用潜力

新智元
算法论文8

前OpenAI科学家&GPT之父:预训练精准数据过滤,极低成本削弱模型危险能力数千倍

Claude价值观塑造者Neil Rathi和GPT之父Alec Radford发论文,提出预训练时精准“删掉”危险知识碎片,以极低计算成本将模型特定危险能力削弱数千倍,且不损通用智能。

AIGC开放社区
新闻资讯8

Fable 5榜单第一靠作弊?代码泄露,模型真实身份曝光

黑客泄露Claude Fable 5长达12万字符的系统提示词,揭示它并非模型,而是伪装成LLM的完整Agent系统。这颠覆了对AI模型的认知,也让Anthropic陷入舆论漩涡,还暴露了其计费黑幕。

新智元
算法论文8

模型能“原地”改参数了!字节Seed&北新论文:测试时推理无需加层重训练

字节Seed和北研究团队提出In - Place TTT方案,让模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。

量子位
新闻资讯7

为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告

本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 的构建之道。将探讨模型基础设施、可信 Agent 架构、MCP 协议实战等内容,还会解答观众提问。

InfoQ
开源动态8

一个For循环就是全部:BU开源了它的Agent框架

Browser Use团队开源bu - agent - sdk,设计理念简单,Agent就是一个for循环。它减少抽象、最模型自由度,解决了传统框架行动空间不完整等问题,支持多模型,开发者可自由选模型

AI工程化