「多智能体行为生成」共找到 5449 篇相关文章
ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式
人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。
超震撼发布!全球首款实时生成游戏引擎Mirage来了
Mirage是全球首个实时生成引擎,借助先进AI世界模型实现实时UGC玩法,支持多种游戏类型。与其他成果相比优势显著,由定制模型驱动,打破传统游戏边界,让玩家动态创造新体验。
世界模型再迎新突破,兔展智能UniWorld-View登顶WorldScore榜单
近年来,世界模型成视觉 AI 重要研究方向。兔展智能联合研发的 UniWorld - View 登顶 WorldScore 榜单,完成昇腾算力适配与开源。它聚焦让 AI 理解未拍摄世界,解决了诸多技术难题。
GPT4核心成员、清华校友赵晟佳任Meta超级智能实验室首席科学家
Meta约一个月前宣布建立「Meta超级智能实验室」,为重振Llama雄风招揽人才。扎克伯格任命GPT4核心成员、清华校友赵晟佳为该实验室首席科学家,其履历亮眼,新研究范式或指明Meta科研方向。
ICLR 2026 Workshop二轮征稿开启:聚焦终身智能体的学习、对齐、演化
人工智能进入转折点,AI Agent 崛起但存在瓶颈。ICLR 2026 会议期间的 Lifelong Agent Workshop 将深入探讨相关问题,推动终身智能体研究范式,现开启二轮征稿。
华为推出软工代码智能体SWE-Lego,解锁SFT训练极致性能
华为研究团队推出仅基于监督微调(SFT)的软件工程代码智能体SWE-Lego,无需复杂RL流程,在SWE-bench Verified基准中表现出色,项目已开源。它有数据、训练和测试时扩展三大创新。
大模型智能体如何突破规模化应用瓶颈,核心在于Agentic ROI
上海交通大学联合中科大研究指出,大模型智能体规模化应用有瓶颈,核心在于Agentic ROI 未达实用门槛。研究提出其发展呈「之字形」,先规模提升信息质量,再轻量化降成本。
释放创造力:解密 AI 贴纸生成器的“神级”提示词模板
文章介绍日本网友分享的 Gem 应用,可上传照片生成各种风格贴纸。详细阐述提示词模板概念、规律特点,还给出波普艺术、日式复古火柴盒等多种贴纸风格提示词库及可用情绪列表,最后鼓励读者动手尝试。
Langchain 、 Manus 组了一个研讨会:Agent越智能,死得越快!
Langchain工程师Lance Martin和Manus创始人Peak季逸超研讨Agent,指出Agent越智能死得越快,原因是疯狂调用工具致上下文过大。还介绍解决方案,如压缩与总结不同,Manus做减法架构更优。
LTX-2开源:首个能同时生成视频和音频的模型
LTX-2开源,它是Lightricks团队开发的首个开源多模态基础模型,能联合生成音频和视频。采用非对称双流扩散变换器架构,用深度多语言文本编码器,速度比许多纯视频开源模型快,让模型理解声画关联。