全栈优化」共找到 3044 篇相关文章

产品应用7

为 OpenAI 秘密提供模型测试, OpenRouter 给 LLMs 做了套“网关系统”

OpenRouter成立于2023年初,为用户提供统一API Key调用各类模型,OpenAI会用其秘密测试。平台token用量高速增长,还发布模型用量排行榜引关注。创始人认为大模型非赢家通吃,未来想成agent最佳推理层。

海外独角兽
产品应用7

一家营收千亿美元的公司,如何回应 AI 落地的策略问题

2025年9月19日,Qwen3和DeepSeek v3.1上线Amazon Bedrock。该产品秉持“Choice Matters”理念,为不同业务选适配基础模型,上架超二百余款模型。亚马逊云科技副总裁总结选模型要点,其策略影响AI落地进程。

InfoQ
新闻资讯8

时隔多年,AI芯片又是华为发布会主角了

华为联接大会上,轮值董事长徐直军带来球最强算力超节点和集群。公布昇腾、鲲鹏芯片未来2年演进规划,还开创灵衢互联协议。虽单芯片受限,但集群层面有望实现超越。

量子位
新闻资讯8

刚刚,OpenAI 发布 GPT‑5-Codex 新模型,专为编程而生

OpenAI 发布专为 Agent 编程优化的 GPT-5-Codex 新模型,在动态思考、性能、代码审查等方面表现出色。同时,Codex 平台大升级,集成 GitHub,保障安隐私,还公布了定价与可用性。

AGI Hunt
算法论文8

提速30倍,Meta重新定义了新一代RAG!

LLM时代,RAG成知识密集型任务标准范式,但处理长上下文时面临延迟高、内存贵问题。Meta超级智能Lab针对RAG特殊结构优化,提出REFRAG框架,有独特训练策略,实验效果显著。

PaperAgent
开源动态8

从第一性原理出发的RAG推理新范式来了,蚂蚁DIVER登顶权威基准

当前RAG系统处理多步逻辑推理任务有局限,蚂蚁集团团队提出DIVER框架解决推理密集型检索难题。它将检索任务分四阶段,在BRIGHT榜单领先,行业对比优势明显,医疗应用效果好。

机器之心
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

深度学习自然语言处理
推荐文章7

我这半年看过最好的 Vibe Coding 技巧

OpenAI 创始成员 Andrej Karpathy 在 X 阐述 Vibe Coding 实践,提出建立三层结构让不同工具各司其职完成开发。介绍不同场景适用工具,还谈及‘后代码稀缺时代’焦虑,给开发者带来启发。

MacTalk
产品应用8

AI智能体加持,爆款视频产出速度提升了10倍,民导演时代已来

Video Ocean在影像创作领域带来革新,通过AI Agent实现一人完成多职能,将拍摄周期大幅缩短。它打造自动化创作生态,能快速批量生成爆款视频,覆盖多种创作场景,操作简单,打破创作壁垒。

机器之心
推荐文章8

大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲

Google DeepMind首席科学家Denny Zhou在斯坦福CS25课程分享大语言模型推理见解,总结了四个关键点,阐述推理机制、优化方法及最新进展,还介绍多种推理方法并比较其优劣。

机器之心