「Agent S3」共找到 4583 篇相关文章
2025上半年大模型使用量观察:Gemini系列占一半市场份额,DeepSeek V3用户留存极高
推特博主「karminski - 牙医」基于OpenRouter数据,分析2025年上半年大模型API市场,涵盖总Token使用量、市场份额、细分领域用量、API接口使用趋势等,得出各模型表现及市场格局的观察结论。
一夜变天!谷歌一刀砍向两巨头:奥特曼急了,黄仁勋慌了
最近谷歌重回AI舞台中央,左手TPU拆解英伟达芯片暴利,右手Gemini 3围剿OpenAI流量帝国。谷歌高管称「Gemini 3开启智能新纪元」,在多项基准测试中超越GPT - 5。Nvidia和OpenAI面临严峻挑战,AI三国混战已开始。
Loop Engineering,4层循环自我进化
Loop Engineering旨在解决人工调度agent的问题,设计系统替人prompt。其系统是四层嵌套循环,从内到外分别让agent干活、干得对、知道何时干、越干越好,还指出优化循环结构收益渐增。
第一章:AI 技术前沿全景
文章聚焦AI Agent技术前沿,阐述大语言模型三次能力跃迁,从涌现能力到对齐指令遵循,再到推理与行动。还提及Scaling Law变化,推理时计算扩展更划算,介绍代表性推理方案及多模态融合,指出Agent打破传统对话AI局限。
让AI智能体拥有像人类的持久记忆:基于LangGraph的长短期记忆管理实践指南
文章围绕让AI智能体拥有持久记忆展开,深入探讨Agent Memory概念,聚焦LangGraph框架下长短期记忆实现,详解存储、管理、检索技巧,还通过引入MCP协议的实战案例展示构建多Agent系统。
GPT-5、Grok 4、o3 Pro都零分,史上最难AI评测基准换它了
AAI机构提出新基准FormulaOne,让GPT - 5、o3 Pro等前沿大模型集体得零分。该基准含220个图结构动态规划问题,分三类难度。测试结果显示,模型在深层及最深层难度表现差,引发关注。
刚刚,全球最难考试惊天大反转!黑马AI冲破36%,顶流模型集体翻车
ARC-AGI-3测试中,顶级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。
开源打破“AI黑箱”!集结全球大咖,GOSIM Paris 2026带你看懂Agent时代大变局
GOSIM Paris 2026在巴黎举办,是面向开发者的开源AI技术大会。大会由GOSIM主办,CSDN等联合打造,聚焦AI能力落地应用。首日Keynote多位大咖探讨AI相关问题,还有三大论坛、工作坊、Hackathon等活动。
DeepSeek重磅开源3B OCR模型,一天处理20万页文档!一天内斩获6K标星!
DeepSeek开源3B OCR模型DeepSeek - OCR,参数量仅30亿,单张A100 - 40G一天能处理20万页文档,不到24小时获6K标星。它是视觉压缩引擎,解决大模型处理长文本算力爆炸问题,有诸多技术亮点。
Github 斩获 16.3k star,Open Lovable 只需1分钟,就能克隆你的任意网站!
Open Lovable 是 Firecrawl 团队开源项目,能通过 AI 聊天将任意网站转化为 React 应用,支持整站抓取与重组。它解决了多类人群痛点,功能丰富,技术架构有优势,在同类对比中表现出色,获 16.3k star。