多代理场景」共找到 5408 篇相关文章

开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
算法论文8

WWW'26 | 跨任务自适应的Multi-Agent协作新范式

大型语言模型驱动的智能体系统成解决复杂任务重要范式,但智能体协作存在关键问题。Griffith和西北农林科技大学团队提出OFA - MAS,将智能体拓扑设计从one - for - one推向one - for - all,实验效果佳。

PaperAgent
算法论文8

综述:LLM 驱动AI Agent通信协议与策略

文章指出传统互联网用户完成行程繁琐,而代理互联网可让代理自动完成。随着LLM驱动智能体应用深入,其发展专业化,需智能体协同,有效通信成关键。介绍了智能体通信定义、分类及种通信协议。

CourseAI
开源动态8

字节开源图像生成“六边形战士”,一个模型搞定人物/主体/风格保持

字节UXO团队设计并开源统一框架USO,解决图像生成指标一致性问题。它能统一看似孤立任务,实现单任务和组合任务的SOTA,弥补了主体保持和风格迁移短板,性能领先,还采用新范式及算法。

量子位
开源动态8

真狠!4 万 Star CodeWhale,AI 写代码最怕的是什么????

文章介绍开源的CodeWhale,它是terminal coding agent harness,GitHub超4万Star。它给代码Agent定规则,涵盖身份、证据等原则。支持模型,有任务流程和Agent协作功能,还分析适用人群并给出启动方法。

小华同学ai
算法论文7

港中文 MMlab×美团新研究:仅用一个模型,应对种视觉推理任务

港中文 MMLab 与美团联合提出 OneThinker 模态统一推理模型,将种视觉任务抽象为‘先推理、后作答’形式,通过任务强化学习优化。实验显示其在任务表现佳,为通用视觉推理模型提供参考。

AI科技评论
新闻资讯8

全网挤爆Seedance 2.5,但2.0 fast降到6毛是真的香!

近期AI视频赛道竞争激烈,FLUX 3登场,国内巨头也纷纷推出新模型。字节Seedance 2.5优势明显,但适用特定场景。Seedance 2.0 fast降至6毛每秒,经场景实测,表现均衡,是性价比之选。

新智元
开源动态8

斩获近5w star!这个开源AI工具让你30 秒搞定“过去30天真相”!

信息碎片化时代,last30days开源AI工具聚合各平台“人群智慧”,按真实人群参与度打分合成摘要。它能搜索平台,v3版有智能搜索等新功能,输出HTML摘要,优点且易上手。

GitHubStore
新闻资讯7

AI 硬件新物种:七位从业者对消费级 AI 硬件的答案

2026 年 CES 落幕,释放中国 AI 硬件集体出海信号。蚂蚁集团等主办的活动上,7 位从业者分享消费级 AI 硬件产品,涵盖养成宠物、智能戒指等。他们认为 AI 硬件竞争焦点正从模型能力转向场景理解。

特工宇宙
开源动态8

面向高效异构训推的统一通信库DeepLink DLSlime开源

上海人工智能实验室开源异构芯片通信库 DLSlime,作为 DeepLink 核心组件,它连接应用和传输链路。具备异构互联、链路支持等亮点,性能优于主流方案,已在实验室个项目验证,还助力国产 AI 工具链发展。

OpenMMLab