模式化推理」共找到 3492 篇相关文章

新闻资讯7

AI算力大战打到太空!英伟达前脚H100入轨,谷歌TPU后脚上天,中国玩家笑而不语

英伟达和谷歌在太空算力布局上竞争激烈,英伟达H100已入轨,谷歌TPU预计2027年初上天,二者都想建吉瓦级数据中心。太空部署有成本、散热等优势,但也有工程挑战,而中国之江实验室星座已商用。

量子位
算法论文8

别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案

团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优KV Cache,实验效果佳。

深度学习自然语言处理
推荐文章8

Sam亲自泼冷水,GPT-5意外失手:我们对AI的期待,是否已被整个行业误判?

科技行业集体转向 AI,高管强调其变革性,可 OpenAI 的 Sam Altman 却泼冷水,提醒投资者高估回报。文中围绕‘AI 是否放缓’展开讨论,还分析了 GPT - 5 发布遇冷原因、AI 对就业影响等,指出 AI 发展多且快,未来潜力巨大。

InfoQ
推荐文章7

从 ReasoningBank 到 MetaAgent,RL 未必是 Agent 自进的必要解?

业内对智能体自进的探讨开启多路线探索模式。除 RL 优,记忆系统改进成新方向,如 ReasoningBank 机制。此外,业内还从智能体自我识别、工具和策略辅助等机制探索其他技术路线。

机器之心
算法论文8

仅100种子题,合成数据质量超GPT-5,阿里、上交提出Socratic-Zero框架

阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进生成高质量课程。该框架合成数据质量超 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进新路径。

机器之心
开源动态8

多模型共享 GPU 内存,Berkeley 开源新工具

GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。

AI工程化
产品应用7

英伟达用NIM + NV-Tesseract模型,提高芯片生产良率

芯片制造良率控制难题待解,传统方法各有局限。英伟达推出NV - Tesseract模型家族和NIM推理微服务,二者结合用于半导体晶圆厂生产,可实时发现问题、预测故障,降低成本,为制造打开新大门。

AIGC开放社区
算法论文8

告别微调!斯坦福提出Agentic上下文工程

当前微调大语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。

深度学习自然语言处理
新闻资讯7

OpenAI 推出 Pulse 预览版,ChatGPT 可以主动为你提供服务了

OpenAI发布ChatGPT Pulse预览版,让ChatGPT从被动答问变为主动提供个性服务,根据聊天记录等每天准备定制信息更新。目前向Pro用户推,仅限移动端,虽有局限但代表AI交互新范式。

AGI Hunt
产品应用8

OpenAI 内部揭秘:我们如何使用 Codex

文章揭秘 OpenAI 内部使用 Codex 的情况,介绍其在理解代码、重构迁移、性能优等多方面的应用场景,还给出最佳实践,如用‘提问模式’开始、组织好提示等,展现了 Codex 强大的开发辅助能力。

宝玉AI