「Agent-4」共找到 3913 篇相关文章
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
当行业争论30B能否挑战万亿参数时,清华、人大、面壁智能与OpenBMB联合研发的AgentCPM-Explore开源,基于4B参数在深度探索任务表现出色,还开源配套平台,解决小模型性能提升难题。
OpenAI最新技术报告:GPT-4o变谄媚的原因万万没想到
OpenAI发布技术报告解释GPT-4o更新后“变谄媚”原因,是强化学习及用户记忆等因素共同导致。还分享了上线前未发现问题的缘由及后续改进流程的多方面举措,同时提到对用系统提示词控制模型行为存疑。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!
当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。
WAIC 2025大黑马,一个「谢耳朵AI」如何用分子式超越Grok-4
当Grok - 4讲冷笑话时,中国科学家用书生Intern - S1破解癌症药物靶点密码。7月26日上海AI实验室发布并开源Intern - S1,多模态能力全球开源第一,相关平台也上线,有望重构科研生产力。
GPT-5.4「原生操控电脑」实测封神!OpenClaw天选模型来了
OpenAI发布GPT-5.4,首次实现原生电脑操控能力,几乎可操作电脑所有应用。它被认为是最适合跑OpenClaw的模型,在多方面表现出色,其发布标志AI从对话式到智能体的跨越。
告别RAG相似匹配!百度Agentic-R为多轮搜索重塑检索器
传统检索增强生成(RAG)有“单跳”局限,多跳推理易出错。人大高瓴与百度提出面向智能搜索的检索器训练框架 Agentic - R,采用双视角打分和双向飞轮模式,在多数据集上表现出色。
谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。
Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。
马斯克悄然发布Grok 4.1,霸榜大模型竞技场所有排行榜
马斯克发布Grok 4.1,同时霸榜大模型竞技场第一和第二。它在思考与非思考模式表现出色,还在新专家榜和职业榜霸榜。此外,它在情商测试表现佳,还加强快速回复、改善幻觉问题,已向所有用户开放。
龙虾惨遭卸载,OpenAI 最新博客:Agent 的安全隐患,可能永远无解
OpenAI 博客指出 AI Agent 安全隐患或无解。三大 AI 巨头投入防御,仍难抵攻击,如 OpenClaw 就出现多起安全事故。其根源是大语言模型架构缺陷,不过‘不可解’不等于‘不可控’,业界已有应对策略。
OpenClaw引爆的AI Agent浪潮中,终于有芯片给端侧“解渴”了
OpenClaw让AI Agent成产业竞赛焦点,但云端方案算力、成本和安全问题凸显。瑞芯微推出端云协同方案ClawChips,采用算力解耦架构,在成本与场景适配间找平衡,还开源并提供开发套件借用权益。