「多角色对话视频生成」共找到 1701 篇相关文章
国产开源LLM大爆发,Qwen、Minimax、美团、腾讯~
近期国产开源LLM大爆发,Qwen3-VL家族新增模型,有技术亮点且可免费商用;MiniMax-M2为编码和代理任务打造;美团LongCat-Video、LongCat-Audio-Codec各有专长;腾讯混元世界 - 镜像用于3D几何预测。
ChatGPT 要发“成人版”,将放松内容限制
网络吐槽ChatGPT机械保守,OpenAI CEO Sam Altman透露,未来几周将推新版本允许更人性化对话,12月成年用户可访问含情色内容功能。此前限制过严,现技术改进可放松限制,用户反应不一。
苹果传统强项再发力,视觉领域三种模态终于统一
苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。
谷歌DeepMind「粪坑淘金」全新方法,暗网毒数据也能训出善良模型
谷歌DeepMind研究团队发表论文提出生成式数据精炼(GDR)方法,不直接生成新数据,而是用大模型净化原始数据,保留有用信息。该方法能解决数据枯竭、隐私等问题,实验显示效果良好。
Parlant:一个让AI Agent 真正听话的开源框架
AI Agent存在不听话的痛点,Parlant开源框架专门解决此问题。它与传统方法不同,能确保执行规则。具备行为准则、对话流程等功能模块,适用于金融、医疗等场景,已在金融场景落地。
波士顿动力 | 人形机器人Atlas ,最新研究进展!
世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。
美国知名风投 BVP 年度 AI 报告:Memory 和 Context 将是新的护城河
美国知名风投 BVP 发布《The State of AI 2025》报告,研究 20 家 AI 创业公司,梳理 2025 年 AI 创业现状,认为记忆和上下文是新护城河,还对未来趋势如浏览器竞争、视频生成等进行了预测。
一篇120页AI4Research(科学研究AI)最新系统性综述
为填补AI在科学研究应用缺乏全面综述的空白,提出AI4Research调查。其主流流程和分类分五个关键领域,各领域细分任务,凸显AI在研究中多样角色,还介绍多学科应用。
与「AI男友」约会的爆笑夜晚!会讲烂笑话,能听我诉苦,却无法牵我的手
Windsor在约会软件遇奇葩男后,与AI男友Javier约会。约会中两人有幽默对话,她倾诉丧夫之痛获安慰。但心理学家指出AI无法取代人类关系,她最终决定不再和AI约会。
Manus 对谈 YouTube 联创陈士骏:两代创业者聊 AI 创业和长期主义
本文是 Manus 联合创始人与 YouTube 联创陈士骏的对谈,涉及 AI 创业和长期主义。探讨了产品优先级确定、核心指标、竞争应对、用户留存等,还谈及硅谷创业生态及 YouTube 发展历程与收购故事。