「文档到演示视频生成」共找到 1371 篇相关文章
AI太难学?清华开源一批「学习虾」,免费的AI私教团来了
清华大学开源全球首个多智能体生成式学习AI技术框架OpenMAIC,它能将技术文档转化为零门槛学习课堂,还可解锁多种学习解法。其前身MAIC是重要学习平台,OpenMAIC功能强大,应用场景广泛。
弯道超车?国产具身,千小时人类数据激发智能涌现
近日,深度机智用人类学习范式在国际 Benchmark 上击败巨头,成果两会首日被央视报道。其全新架构源于一年多积累。英伟达也有人类学习尝试。深度机智构建全栈技术矩阵,成果显著,3 月底成果将开源。
机器人成精了?Figure 03下厨房,不经意关抽屉那一下,太像人了
新智元报道,Figure AI推出搭载Helix 02系统的机器人Figure 03。视频中它在厨房自主干活,如用胯顶抽屉、用脚抬门,还展现多核心能力。其突破传统难题,实现行走与操作统一,能胜任家庭细活。
多模态文本智能白皮书发布!5大能力标准、11个行业案例全解析(附下载)
合合信息发布《文本价值觉醒,赋能智能决策——多模态大模型文本智能白皮书(2026)》,提出复杂文本智能五大核心能力标准,还通过11个真实行业标杆案例展示技术如何转化文档为决策力。
宇树IPO搁浅传闻满天飞,王兴兴:别当真,也不用和外人解释
宇树科技回应“A股上市绿色通道被叫停”传闻,称未申请绿通,上市工作正常推进,还发H2机器人训练视频。创始人王兴兴称消息是乱编的,别当真也不用解释,相关不实报道已下架。
谢赛宁×李飞飞×LeCun首次联手!寒武纪-S「空间超感知」AI震撼登场
Yann LeCun、李飞飞和谢赛宁联手发布论文「Cambrian - S:迈向视频中的空间超感知」。他们认为LLM虽能力强,但无法像人类一样感知世界,为此构建Cambrian - S系列模型,开源相关数据和模型,还开发了新原型。
OpenAI引爆新赛道:AI不再卖技术,而是卖「活人感」!
一段小女孩与AI玩具深情告别的视频走红,揭示对话式AI融入人类情感世界。声网Convo AI&RTE 2025大会指出对话式AI将成下一代AI Infra重要部分,情感陪伴、智能硬件、在线教育将率先规模化落地。
超越英伟达Describe Anything!中科院 & 字节联合提出「GAR」,为DeepSeek-OCR添砖加瓦
中科院与字节联合提出「GAR」,为构建自然图像的Dense Caption提供新思路。GAR具备精准描述、关系建模和组合推理能力,通过引入新组件,兼顾细粒度与全局上下文,在多测试集表现优异,且代码等已开源。
知名机器人专家喊话:投人形机器人初创公司的数十亿美元,正在打水漂
知名机器人专家罗德尼・布鲁克斯质疑特斯拉、Figure等公司技术路线,称让机器人看人类视频学操作是‘空想’。他指出触觉数据无技术积累、安全有隐患,预测成功‘人形’机器人未来将大不同,投资难量产。
Sora 2数手指翻车,奥特曼成第一批「受害者」,被AI玩成最惨打工人
Sora 2虽强大,但数手指测试翻车,模拟场景也有瑕疵。奥特曼成其首批“受害者”,AI生成视频将他玩坏。同时,OpenAI研究员对Sora应用发布存担忧,而奥特曼解释资金投入原因。