「多模型调度」共找到 9756 篇相关文章
TEN VAD 开源:低延迟、高准确率,提升「语音 Agent」上限就靠它!
TEN-VAD是专为实时流式语音场景优化的开源模型,能解决语音交互中常见问题。它轻量级、跨平台、高性能、低延迟,获大佬背书,在多场景是必选组件,是语音交互里易被忽略却难替代的一环。
CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍
随着高分辨率图像与长视频处理需求增长,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。
Qwen-Image-2.0: 字字清晰,张张细腻
阿里云推出Qwen-Image-2.0图像生成基础模型,具专业文字渲染、细腻真实质感等特色。在AI Arena盲测中表现优越,能精准生成复杂内容,文字渲染有准、多、美、真、齐特点,图像编辑能力也得到增强。
获NVIDIA致谢:悟空Agent的实践、复盘与迭代
本文以悟空Agent获NVIDIA致谢为切入点,介绍多智能体架构闭环及实战挑战,如上下文断流、调度失衡。还阐述架构设计、迭代优化、数据飞轮体系,指出AI infra存在安全隐患,强调安全融入业务的重要性。
龙虾再进化!强化飞书表格技能,25.2万星登顶超越React/Linux
OpenClaw 2026.3.1正式发布,合并九十多个PR。其Star飙升至25.2万颗,超Meta的React登顶GitHub。更新核心卖点有二:模型武装升级,安卓节点玩法扩容;对国内使用更友好,可在飞书文档操作,Web UI支持双语。
LSTM之父Jürgen再突破,「赫胥黎-哥德尔机」让AI学会自己进化
LSTM 之父 Jürgen Schmidhuber 对 2003 年提出的哥德尔模型进行新尝试,构建赫胥黎 - 哥德尔机(HGM)。它能在 SWE - Bench Lite 媲美最佳人类设计智能体,还在多基准测试中超越现有方法,展现强大迁移能力。
实测腾讯首个 AI IDE 产品,小白也能『批量开发』微信小程序
2025年AI Coding领域竞争激烈,腾讯7月22日揭幕国内首款“产—设—研”全链路AI IDE CodeBuddy。它支持主流模型,能将想法转化提示词等,通过多个案例展示其强大功能,腾讯还计划让其普惠开发者。
提出“AI虚拟细胞”的团队,现在要虚拟整块组织了
2024年12月,瑞士洛桑联邦理工学院夏洛特·邦纳团队提出“AI虚拟细胞”。一年多后,AIVC方向有进展,但虚拟组织层面工作少。近日团队推出VirTues基础模型,解决空间蛋白质组学数据分散问题,在多任务表现好,还用于三阴性乳腺癌预测。
吴恩达最新来信:是时候关注并行智能体了
吴恩达在最新来信中指出,并行智能体正成为提升AI能力新方向,多个agent协作能高效处理不同任务。相比依靠数据和算力提升性能的方法,并行agent提升性能同时无需用户久等,且大模型token成本下降使其可行。
56倍加速生成式策略:西交大提出EfficientFlow,迈向高效具身智能
生成式模型在机器人和具身智能领域面临训练依赖大量数据、推理慢的问题。西安交通大学团队提出EfficientFlow,融合等变建模与高效流匹配,提升数据效率,压缩推理迭代步数,在多基准实现SOTA,推理提效显著。