「策略性能提升」共找到 4644 篇相关文章
Qwen3新成员:Embedding系列模型登场!
今天正式发布Qwen3-Embedding系列模型,专为文本表征等任务设计,继承Qwen3多语言理解优势。在多项基准测试表现卓越,已在多平台开源,有卓越泛化性、灵活架构与多语言支持等特点。
Deep Search 如何理解业务仓库代码?
文章系统介绍Deep Search和Deep Research概念、与传统RAG区别、主流商业产品与开源方案、在代码领域应用及未来规划。提出Deep Search方案,构建独特代码理解与检索架构,还计划研发专用代码搜索Agent。
“最强编码模型”上线,Claude 核心工程师独家爆料:年底可全天候工作,DeepSeek不算前沿
Anthropic 开发者大会发布 Claude 4 ,含 Opus 4 和 Sonnet 4 型号,在基准测试表现出色。核心工程师预测年底软件工程智能体能力,谈 RL 及 DeepSeek,还提到模型自我意识、推理计算瓶颈等问题。
英伟达让机器人「做梦学习」,靠梦境实现真·从0泛化
英伟达推出DreamGen项目,让机器人‘做梦学习’。它利用视频世界模型生成神经轨迹,仅少量现实视频就能让机器人学会新任务,实现从0泛化,还将助力GR00T - Dreams发展。
谷歌开发者大会炸场!Agent重磅升级, A2A、SDK大更新
今天凌晨谷歌召开‘I/O 2025’开发者大会,对Agent智能体重磅升级。A2A协议更新,新增关键功能,还发布官方Python SDK;生态持续扩大,多家名企加入。此外,发布Agent Engine UI,升级Agent SDK,增强Project Mariner能力。
继MCP、A2A协议之后,又一个Agent协议AG-UI来了
AI Agent交互协议不断演进,在MCP、A2A协议后,copilotkit发起AG - UI项目,构建开放、轻量级、基于事件的Agent - 用户交互标准化协议,侧重前端交互,已获部分框架兼容。
DeepMind 提出 CaMeL,抵御 LLM 提示词注入
谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。
AGI失控率>90%!MIT教授算出「康普顿常数」,AI地球「夺权率」已锁定?
MIT教授研究指出,即使采用理想监督机制,人类成功控制超级智能概率仅52%,全面失控风险超90%。研究通过量化分析提出嵌套可扩展监督等理念,并在四个真实监管场景验证,探讨如何优化现实监管系统。
SGLang 某些模型的 CUDA Graph 为什么会有上百条 decode cuda stream?
本文分析SGLang运行DeepSeek-V4.1时,CUDA Graph出现上百条decode CUDA流的问题成因,介绍开源PR的修复方案,分享了压缩profiler显示行数的实用脚本方法。
Anthropic发布Fable 5.1:科研、编程能力翻倍,成本最高降45%
当地时间9月1日,Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1科研、编程能力翻倍,成本最高降45%,还能解决实际问题,此次模型竞争转向多方面综合较量。