「多AI Agent」共找到 12355 篇相关文章
一文读懂 Deep Research:竞争核心、技术难题与演进方向
文章梳理了深度研究系统,包括其发展历程、现有系统差异、技术实现挑战、评估体系及推理架构演进方向。指出竞争焦点转向综合比拼,评估走向专业化,未来系统将在多方面突破。
1200行代码逆袭!DeepSeek工程师开源轻量级vLLM,吞吐量逼近原版
开源 vLLM 可提升 LLM 推理速度和资源利用率。近日,DeepSeek 工程师俞星凯开源轻量级 Nano - vLLM,代码仅 1200 行,基准测试中吞吐量逼近原版,项目已在 GitHub 获 200 多 Star。
加速200倍,单显卡1.8秒生成5秒高清视频!清华与Vidu解开了视频扩散模型的速度枷锁
清华、生数科技与伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。
Rust 天花板级大神公开发帖找工作:3000 次核心提交,不敌 “会调 OpenAI API、用 Cursor”?
Rust 编译器核心贡献者 Nicholas Nethercote 和 Michael Goulet 因团队缩编等原因公开找工作。Nicholas 称 AI 吸走大量资金与注意力,使 Rust 项目资源减少。同时,Unix 联合创始人质疑 Rust 能否取代 C。
时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8
在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。
这次,Token要直接发给学生,每人30万元
AI时代Token已成为核心科研资源,高校学生普遍面临Token匮乏、科研试错成本高的痛点。腾讯启动第二届青云奖学金,为每位获奖学生提供30万元Token额度加20万元现金,还配套产业交流资源。
双核发布!“幻镜”第四季+“微笑曲线”计划亮相广电媒体融合大会首创郎园2026年5月13日 15:57 北京 听全文
第六届中国(北京)广电媒体融合发展大会举行,首创郎园赵春燕发布“幻镜”AI视听测评季第四季及“微笑曲线”视听IP运营扶持计划。前者构建测评体系,后者打通视听IP全链路。
声音自然、接近真人,只要 3 秒音频就能完成声音克隆,可本地跑保护隐私的TTS!
Neuphonic出品端侧TTS模型NeuTTS,能在本地设备高效运行,无需云服务。它有真正端侧运行、低延迟、高质量自然语音等特性,支持多语言,项目还给出安装、使用方法及支持模型等信息。
tokens烧钱太快?试试这个四层模型组合
ClaudeCode等智能体兴起,开发者面临tokens不够用、主流模型降智问题。网络给出多模型策略缓解,网友将2026年主流模型分四档,还介绍了实际路由策略、部署建议,指出单模型依赖危险。
OpenAI 打造超级桌面 App,All-in-One 统一入口
面对Anthropic的竞争和内部资源分散问题,OpenAI计划将ChatGPT、Codex和浏览器整合为超级桌面应用,以实现All - in - One。转型有“Agentic”能力亮点,但面临组织、商业、安全挑战,还收购Astral等公司助力。