主动防御框架」共找到 1888 篇相关文章

产品应用8

干翻全场!OpenAI深夜发布通用Agent。

OpenAI 发布 ChatGPT Agent,将 Operator 和 Deep Research 能力融合,能在虚拟电脑完成复杂任务。它功能强大亮点多,但也存在价格昂贵、安全隐患等问题,或压缩创业公司空间。

探索AGI
开源动态8

谷歌T5Gemma重燃架构之战!「套壳」反杀Gemma本尊,9B推理快得离谱

2023年以来大模型战场由decoder - only架构主导,Google双线出击。T5Gemma重燃encoder - decoder架构战火,性能提升显著;MedGemma坚守decoder - only路线,强攻医疗多模态,击穿闭源壁垒,打响开源反击战。

新智元
算法论文8

告别数据「噪音」,UCSD大模型推理新方法DreamPRM充当「信号放大器」,登顶MathVista测评榜

DreamPRM由加州大学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态大模型集成,提升推理能力,实验效果显著。

机器之心
算法论文8

Google新研究:降低大模型幻觉的全新视角——充分上下文!

谷歌新研究《SUFFICIENT CONTEXT: A NEW LENS ON RETRIEVAL AUGMENTED GENERATION SYSTEMS》提出“充分上下文”概念,剖析RAG系统失败原因并给出解决方案,对提升企业AI准确性和可靠性有重要意义。

AI工程化
算法论文7

DeepMind 提出 CaMeL,抵御 LLM 提示词注入

谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。

InfoQ
产品应用7

评论送书 | 我用扣子(Coze),五分钟搭建出一个客服自动应答智能体

文章以设计‘产品功能咨询智能体’为例,介绍用扣子平台搭建客服自动应答智能体的全过程,包括创建项目、工作流、搭建流程框架及试运行优化,还推荐了相关书籍。

AIGC开放社区
开源动态8

1.9K Star!给 DeepSeek Harness 装上侧边工作台,文件、终端、Git、浏览器、插件一屏搞定!

DeepSeek Harness 是 AI Agent 运行框架,自由度高但默认 Web UI 操作不便。社区插件 DSH - better - sidebar 迅速出圈,装了侧边工作台,整合多样工具,更新勤,适合折腾 DSH 的人。

开源星探
算法论文8

迈向长程智能体,人大高瓴发布149页全景综述

新问题出现,长程智能体研究应运而生。人大高瓴发布149页综述,梳理超900项研究,从多视角给出长程智能体统一定义、分类与路线图,分析难点,提出核心论点与发展路径等。

机器之心
新闻资讯8

断网解题,Claude Mythos推翻Erdős 80年猜想!比OpenAI更短更漂亮

OpenAI用125页思维链解开Erdős 80年猜想,Anthropic研究员Levent Alpoge让Mythos断网测试,找到更短更简洁路径。Mythos用数论方法打破僵局,过去一周OpenAI、DeepMind、Anthropic分别攻克相关难题。

新智元
推荐文章7

1M 上下文时代太费 Token,告诉你我的 Coding Agent 省钱方法

当下GPT-5.5等模型原生支持1M上下文,虽能支撑长任务,但易被噪音干扰且费Token。作者以Claude Code为例,介绍做好会话管理的多种省钱方法,如根据任务选择会话策略、利用rewind功能等。

MacTalk