多人图像生成」共找到 2428 篇相关文章

算法论文8

只演示一次,机器人就会干活了?北大&BeingBeyond联合团队用“分层小脑+仿真分身”让G1零样本上岗

北大与BeingBeyond团队提出DemoHLM框架,仅需1次仿真演示就能生成海量训练数据,解决人形机器人移动操作数据效率低、任务泛化差、Sim-to-Real迁移难的问题,在仿真和真实机器人上验证效果良好。

量子位
新闻资讯7

ChatGPT正测试神秘功能

ChatGPT正测试“Study Together”新功能,已出现在部分订阅用户工具列表。它或更多提问题让用户答,类似对谷歌LearnLM的回应,有望发挥积极教育作用,减少被滥用可能,也可能支持多人学习小组模式。

AIGC开放社区
算法论文8

732M模型超越7B!机器人操控新范式:从视频中「悟」物理

机器人操控有「数据困境」,传统方法需大量人工标注动作演示数据。中山大学王广润教授团队从视频生成模型「借」物理直觉,提出PAR和PhysGen,与英伟达DreamDojo核心思路一致,验证了新的技术路线。

新智元
开源动态8

语音“PS”来了!蚂蚁又放大招,ASR+TTS+编辑的全能语音模型开源了!

在大模型浪潮下,语音领域迎来“整合与统一”趋势。阿里蚂蚁团队推出端到端统一语音模型Ming - UniAudio,能在一个框架下完成识别、生成、编辑等任务,语音编辑能力创新,开发者上手简单。

开源星探
产品应用8

全球首款AI原生UGC游戏引擎诞生!输入文字秒建GTA世界,试玩体验来了

全球首个由实时世界模型驱动的AI原生游戏引擎Mirage问世,玩家能实时构思、生成并体验游戏世界。虽当前体验有不足,但它有显著优势,支持多元游戏类型,基于前沿技术构建。

机器之心
产品应用8

不是,高考刚结束,高考报志愿的Agent也来了?

夸克官宣夸克高考志愿大模型,虽未多提Agent,但作者认为其比Agent还Agent。该模型免费,以Qwen为基座,结合高考知识库,能生成详细志愿报告,考虑多方面需求,助力学子报志愿。

数字生命卡兹克
开源动态7

《Loop Engineering橙皮书》发布!免费,开源

《Loop Engineering橙皮书》发布,免费开源。Loop Engineering概念由多人共同推动,它是在提示词、上下文、缰绳工程基础上更进一步。文中介绍了循环的动作、零件,Claude Code的相关命令,也指出新手实践的坑。

花叔
新闻资讯7

美军杀人AI猛料曝出!Claude24小时锁定伊朗1000个目标,战争彻底变天

外媒爆料,美伊冲突中,美军让Claude与Maven系统合作,24小时锁定1000个目标。Maven能整合多数据源、分析态势、生成建议。如今AI公司纷纷进军军工,AI让战争更快、更难控。

新智元
新闻资讯8

人类首次机械飞升!马斯克豪言Neualink击败全人类

马斯克发推称Noland可能首接受Neuralink升级或植入双芯片,还豪言接受者能在动作游戏击败所有人。Neuralink已植入12人,累计超2000天,还提交人体数据论文、开启意念生成文字试验。

新智元
产品应用8

快手AI超级员工上线!一句话剪出完整短视频,从文案到发布一条龙

快手AIGC超级员工Kwali正在内测,可一句话生成完整短视频。它整合多Agent框架,有素材库和数字人资源。能完成脚本、拍摄、剪辑等环节,降低视频制作门槛,重构视频供应链。

量子位