「视频动捕」共找到 1105 篇相关文章
多模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案
上海人工智能实验室等团队提出全新生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。
14岁初中辍学 vs 13岁开始写代码:非标准AI创业者的打开方式
文章讲述了谢扬、秦天与邓杰两位非标准AI创业者的故事。出身不同的他们,分别创立了Fellou与Proactor AI。访谈中,三位分享创业体验、产品理念等,展现AI创业早期不问出身,机会奖赏先出发者。
AI 增强截图项目,爽歪歪~
日常截图后手动处理文字、公式、表格耗时又易出错。开源项目`Snippai`将截图与智能分析融合,是跨平台智能截图工具,能自动识别内容类型并处理,有多种功能,安装使用简单。
AI+直播的新玩法! StreamDiffusionV2让创意零延迟
生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。
GAIR Live 预告|智能始于记忆,AgentMemory 的技术演化过程
在人工智能走向智能体阶段,‘记忆’成焦点。如今大模型‘记不住’上下文,‘从Human Memory到Agent Memory’跃迁是迈向具身智慧关键。GAIR Live将邀专家探讨记忆技术逻辑与路径。
NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下多模态冠军!
英伟达推出全模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,多测试中大幅超 Qwen2.5 - Omni,且训练量仅为其六分之一。其架构经多阶段流程实现全模态理解,还支持多种功能。
万万没想到,大学生都开始拿AI来养猪了
夸克在中国人民大学分享会曝光大学生使用情况,每10个大学生中有7人用夸克,AI渗透率达80%。学生不仅用其学习,还用于生活。不过夸克高考曾出现信息错漏,后已修正。
群核科技开源两款空间大模型,想解决 Genie3 没能彻底解决的问题
2025年8月25日群核科技举办TechDay,发布专注3D室内场景的空间大模型,开源SpatialLM 1.5和SpatialGen。两款模型分别解决理解交互和空间一致性问题,有实际应用价值,还介绍了数据飞轮效应及模型相关问答。
90%打工人「自费买AI上班」,开启To P革命!每月花20刀效率翻倍
面对AI淘汰焦虑,大量职场人主动自费买AI工具,开启「自我拯救」运动,催生出To P新赛道。文章分析其发展快的原因,也提及To B和To C赛道后续发展的条件。
普通程序员怎样转到AI方向拿到更好的offer
在AI研究员拿天价offer的当下,探讨普通程序员转AI方向拿更好offer的方法,还介绍了AI生态的五个层次,包括各层岗位、年薪及容量。