可交互音视频」共找到 5044 篇相关文章

算法论文8

独家!哈工大斩获AI顶会ACL评审阶段最高分,让AI领略汉字之美

哈工大论文获AI顶会ACL 2025评审阶段已知最高分。团队用传感器捕捉手部书写实现汉字输入识别,独创中文字形编码让AI理解汉字形态,革新中文人机交互,推动汉字文化传承,为AI理解汉字开辟新路。

新智元
新闻资讯8

医疗AI十年,终于有人跑通了最难的一关|甲子光年

2026年5月20日,德适AI AutoVision®染色体核型辅助诊断软件获国家药监局第三类医疗器械注册证。这验证了iMedImage®基座模型产出产品通过最高等级监管审查,为医疗AI产业化提供了行路径。

甲子光年
新闻资讯7

用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!

当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练AI模型,Business和Enterprise用户除外。GitHub称需更多数据覆盖编码场景,但此举遭用户吐槽。

AI前线
推荐文章7

为什么软件工程治理很重要:降低风险但不拖累速度

Sarah Wells 在哥本哈根 Goto 会议称,软件工程治理助团队决策、支持价值交付。糟糕治理会拖慢进度、增加成本。技术策略和组织技术雷达辅助决策,还能从 DORA 能力学治理。

InfoQ
新闻资讯7

独家|华为系帧跃科技完成千万美金天使轮融资,将发布视频产品 Leadde

AI 科技评论独家获悉,主攻 AI 交互视频赛道的帧跃科技完成千万美金级天使轮融资。创始人杨昌鹏和联合创始人李明磊均有华为任职经历。公司提出‘三位一体’架构,2026 年下半年将发布产品 Leadde。

AI科技评论
算法论文7

HOIDiNi:一句话驱动虚拟人高精度操作物体

特拉维夫大学提出HOIDiNi,这是文本驱动的扩散框架,用于生成人体 - 物体交互动作。它引入扩散噪声优化,能兼顾真实感与物理正确性。不过它泛化能力待拓展、生成速度慢,未来需提升效率等。

带你学AI
产品应用7

上手“设计界的Manus”,朱啸虎点赞,Lovart这波魔法破圈了丨TIP 002

国产出海产品Lovart被称为“设计界的Manus”,获朱啸虎点赞。它是设计领域首个Agent,能用自然语言驱动生成多模态视觉作品,生成VI体系、短片等,适合文创领域,还能人工编辑,调用多模型。

鲸选AI
推荐文章8

YC 总裁:2026,个人 AGI 已来

YC总裁Garry Tan在演讲中指出AGI已来,给出全新定义框架,强调其成个人资产。他介绍了个人AGI存在形态、搭建步骤,还探讨其归属,鼓励大家主动构建。

特工宇宙
开源动态8

一个图形界面管好所有Win软件包,爽!

Win系统装软件易遇‘全家桶’,开发者管理包管理器繁琐。开源神器UniGetUI聚合主流包管理器软件源,在清爽界面搜索、安装、更新和卸载软件,功能丰富,还提供多种安装方式。

开源先锋
产品应用7

秘塔 AI,悄咪咪上线「今天学点啥」App

作者受手机厂商将AI功能做成NFC卡片启发,提出把知识载体变成Agent的想法。秘塔AI观点与其不谋而合,还将「今天学点啥」做成独立App,个性化学习,体验超预期。

特工宇宙