视频换装框架」共找到 2480 篇相关文章

算法论文7

人多不管用!智能体团队别盲目扩张,最新综述给出三大维度

随着大语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩大后会失稳、低效。美国、英国和澳大利亚研究人员提出三维分类框架描述大规模智能体网络,指出真正决定系统表现的是三种机制组合。

新智元
开源动态8

NVIDIA 开源 Live VLM WebUI:摄像头实时测试视觉语言模型

NVIDIA 开源 Live VLM WebUI,可让用户在本地用摄像头实时测试视觉语言模型。它基于 WebRTC 技术,能将摄像头视频流实时传输给模型,分析结果叠加在画面上,支持多后端、多平台及多种模型。

AI工程化
算法论文8

Meta-Think ≠ 记套路,多智能体强化学习解锁大模型元思考泛化

上海交通大学等团队提出ReMA框架,将复杂推理解耦为元思维和推理智能体,通过迭代强化学习协作。在单轮实验中,ReMA在多基准测试表现优;多轮实验虽有提升但不稳定,需进一步探索。

机器之心
产品应用8

传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。

机器之心
产品应用8

Claude Fable 5怎么用?Anthropic 工程师:干你也不知道的事

Anthropic的Claude Code工程师Thariq Shihipar发长文介绍Fable 5使用方法。他认为与Fable 5协作要发现未知,其定位解决复杂问题。还将未知分类,给出任务前中后打法,并举例用Fable 5剪视频

AIGC开放社区
算法论文8

AdaGen: 让图像生成模型学会自适应策略

当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。

机器之心
新闻资讯7

马斯克的「移动客厅」又火了:20人座无方向盘,每公里才3毛钱

前段时间旧金山大停电,Waymo无人驾驶出租车趴窝,特斯拉汽车不受影响。网友翻出特斯拉Robovan视频,马斯克称其将改变街道面貌。该车20人座无方向盘,运营成本低,预计2027年量产,此外马斯克身价破7000亿美元。

机器之心
算法论文7

苹果光速撤回RLAX论文:用了谷歌TPU和阿里Qwen,作者中还有庞若鸣

苹果一篇新论文在 arXiv 公开后匆匆撤稿。该论文揭示基于 TPU 的可扩展 RL 框架 RLAX,用了谷歌 TPU、亚马逊云及阿里 Qwen 模型,还介绍其架构、策略支持等,实验结果亮眼,也分享 Debug 过程。

机器之心
推荐文章8

AI教母李飞飞最新长文:空间智能是AI的下一个前沿「LLM太局限了,缺乏现实根基」

AI教母李飞飞最新文章指出,以LLM为代表的AI技术虽改变世界,但缺乏现实根基。要让AI与物理世界互动,需迈向空间智能,她还提出构建世界模型框架及面临的挑战和应用前景。

AI寒武纪
算法论文8

ICML 2025 | 给AI装上「智能升级插件」!阿里安全-清华大学D-MoLE让模型在持续学习中动态进化

近日,阿里巴巴集团安全部 - 交互内容安全团队与清华大学联合研究成果被 ICML 2025 收录。他们提出 D - MoLE 框架应对多模态大模型持续学习挑战,实验显示其性能优、训练快,还能用于提升阿里安全审核模型适应力。

机器之心