「端到端加速」共找到 2809 篇相关文章
微软 Build 2025:AI 智能体时代与开放智能体网络的构建
微软 Build 2025 大会展示迈向 AI 智能体时代路径,如发布新功能助力开发者,让 AI 智能体更强大安全,支持开放智能体网络,还推出平台加速科学发现。
Meta超级智能实验室首篇论文:重新定义RAG
Meta超级智能实验室首篇论文提出REFRAG框架,重新定义RAG。它通过“压缩、感知、扩展”流程优化LLM处理外部知识方式,最高将首字生成延迟加速30倍,且性能无损。
DeepMind大佬最新暴论:单体大模型穷途末路,未来买的不是模型,是"智能路由"
DeepMind研究员Andrew Trask认为,因Scaling Law对资源需求攀升,AI将成协议而非程序。组合不同厂商模型有优势,当主流榜单同等评分时变革加速,之后人们将买“智能本身”。
Karpathy加入Anthropic要做的事,被Google提前做了
Karpathy官宣加入Anthropic要组建新团队‘用Claude加速预训练研究’,话音未落,Google&Meta等发论文‘LLMs Improving LLMs’验证了该思路。论文让Claude Code搜索最优推理策略,结果全面超越人类设计。
AMM|西工大 董戴玮、索玮、寇家庆、张伟伟:PINN-MG——受多重网格启发的迭代法与物理信息神经网络混合求解框架
西北工业大学团队提出PINN - MG框架,结合迭代法与物理信息神经网络。迭代法消除局部高频振荡误差,PINNs校正全局低频误差,在多方程测试中加速效果显著,还克服不定亥姆霍兹方程求解发散问题。
Claude正式登陆Xcode
Xcode 26更新对Claude原生支持,将AI编程助手融入代码编辑器。开发者可在Xcode用Claude加速开发,有代码助手和编码工具等功能,订阅机制合理,还给出启用方式。
阿里AI重组:集团CEO吴泳铭亲征!「Token为王」全面决战ASI
阿里宣布成立全新的Alibaba Token Hub(ATH)事业群,由CEO吴泳铭挂帅,收拢通义千问等团队。这标志阿里AI战略转向,告别技术至上,聚焦B端商业变现与算力应用,围绕Token构建工业化流水线。
说实话提前拿到Qwen3.7-Max内测,最让我意外的不是它推理变强了!
作者提前2天拿到Qwen3.7-Max内测,经测试,该版本补齐短板,综合能力强。审美提升明显,代码质量不错,长程思考推理迭代能力佳,适合替换到部分工具里。
DeepSeek深夜更新后自曝:我是V4(?!)
DeepSeek网页端深夜大更新,推出「快速模式」和「专家模式」,还有「视觉模型」开启灰度测试。虽官方未说明,但网友推测专家模式可能是V4或V4 Lite,完整版V4或许不远。
Hugging Face刚刚开源了一个MCP全面指南~
Hugging Face推出免费开源的MCP课程,涵盖从理论学习到实践应用的内容。介绍了无MCP时开发的复杂情况,以及使用MCP可降低集成复杂性和维护负担,还说明了MCP架构的组件。