「多Agent架构」共找到 7130 篇相关文章
加速200倍,单显卡1.8秒生成5秒高清视频!清华与Vidu解开了视频扩散模型的速度枷锁
清华、生数科技与伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。
时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8
在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。
苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人能开发AI应用
苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功能,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功能将逐步开启测试,今年秋季部分用户可用。
超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
独家|华为系帧跃科技完成千万美金天使轮融资,将发布视频产品 Leadde
AI 科技评论独家获悉,主攻 AI 交互式视频赛道的帧跃科技完成千万美金级天使轮融资。创始人杨昌鹏和联合创始人李明磊均有华为任职经历。公司提出‘三位一体’架构,2026 年下半年将发布产品 Leadde。
声音自然、接近真人,只要 3 秒音频就能完成声音克隆,可本地跑保护隐私的TTS!
Neuphonic出品端侧TTS模型NeuTTS,能在本地设备高效运行,无需云服务。它有真正端侧运行、低延迟、高质量自然语音等特性,支持多语言,项目还给出安装、使用方法及支持模型等信息。
tokens烧钱太快?试试这个四层模型组合
ClaudeCode等智能体兴起,开发者面临tokens不够用、主流模型降智问题。网络给出多模型策略缓解,网友将2026年主流模型分四档,还介绍了实际路由策略、部署建议,指出单模型依赖危险。
OpenClaw现在可以直接生成视频了,支持12家视频模型提供商
Peter Steinberger宣布OpenClaw新版推视频生成功能,让Agent完成文本到视频流程。它集成12家视频生成提供商,异步生成,使用简单,支持丰富参数配置,官方文档见https://docs.openclaw.ai/tools/video-generation 。
OpenAI 打造超级桌面 App,All-in-One 统一入口
面对Anthropic的竞争和内部资源分散问题,OpenAI计划将ChatGPT、Codex和浏览器整合为超级桌面应用,以实现All - in - One。转型有“Agentic”能力亮点,但面临组织、商业、安全挑战,还收购Astral等公司助力。
黄仁勋:龙虾就是新操作系统!英伟达7种芯片拼出算力怪兽,放话2027营收万亿美元
英伟达GTC 2026上,黄仁勋回顾发展历程后预计2027年营收至少达1万亿美元。介绍Token工厂经济学,推出Vera Rubin系统,还谈及OpenClaw,断言企业IT逻辑将改写,也预告了Feynman架构和太空数据中心。