「智能视频云」共找到 4601 篇相关文章
刚刚,国产AI自己造了AI,全球首例!
面壁智能实现全球首例国产AI造AI,用AI编写预训练框架ForgeTrain,性能超英伟达Megatron,还训练出MiniCPM5 - 1B模型。该模型可作桌宠,小尺寸高智能,还能自定义人格,提供工具链。
微软发布5大AI Agent模式:一键解锁AI员工,打造智能体工厂
今天凌晨微软官网发布5种常用Agent模式助用户开发自动化AI员工。智能体比传统自动化工具更具优势,能推理协作等。各模式都有应用案例,且Azure AI Foundry支持多Agent模式开发。
亿点点新融资砸向具身智能:斯坦福华人团队,首创“自适应机器人”品类
具身智能火热,非夕科技完成C轮亿级美元融资,由咏归基金、广发信德联合领投。该公司由斯坦福大学相关成员创立,首创“自适应机器人”品类,此轮资金用于扩产、研发及生态拓展。
UI-TARS-desktop:字节跳动的原生GUI智能体,用自然语言控制电脑和浏览器
字节跳动开源的UI-TARS-desktop是原生桌面GUI智能体工具,基于UI-TARS和Seed-1.5-VL系列模型。能用自然语言操控电脑和浏览器,有本地和远程两种模式,支持多平台,还对比了同类工具。
长视频会议纪要、访谈节目精剪AI神器
WhisperVideo是用于长篇幅、多说话人视频的简洁演示系统,专为真实对话构建。它有SAM3视频分割、TalkNet主动说话人检测等功能,具备视觉关联说话人归属等特性,文中还介绍了安装、运行等内容。
智源清华带来PAM,手物交互数据生成新SOTA | CVPR 2026
北京大学、清华等联合提出统一引擎PAM,能整合姿态、外观和运动。用户提供初始和目标姿态及物体几何形状,它就能生成逼真手物交互视频。其效果超现有方法,合成视频可用于数据增强。
智能老师的“成人礼”:一只中国独角兽如何在《时代》岸边重新定义“教育奇点”
2025年《时代》周刊“最佳发明”榜单中,松鼠Ai多模态智适应教育大模型作为教育科技领域唯一中国力量入选。其创始人栗浩洋锚定L5级自主教学目标,成果经多地实践验证,还推动教育公平走向全球,牵头制定AI教育标准。
Memvid:把你的文档库变成一个小巧的视频,还能瞬间搜出你想要的!
传统向量数据库因高成本和复杂运维让开发者却步。开源项目Memvid将文本数据存入视频文件,能高效检索,解决存储冗余、检索延迟和网络依赖问题,使用简单,虽处概念原型阶段但值得尝试。
让 AI 自己打怪升级,Meta用Self-play RL把Coding推向超级智能
Meta FAIR、Meta TBD Lab等朝着“超级智能软件工程Agent”迈出第一步。SSR让大模型零人类标注,靠自生成Bug和自修复稳定碾压人类数据基线,新旧范式对比优势明显,还介绍方法、实验结果与理论洞察。
首个地球科学智能体Earth-Agent来了,解锁地球观测数据分析新范式
上海人工智能实验室与中山大学联合研发的 Earth - Agent 解决了多模态大语言模型用于地球科学研究的痛点。它将领域知识工具封装化,利用 LLM 智能规划调度。经 Earth - Bench 评估,其在多方面表现出色,未来发展前景广阔。