电影级视频」共找到 1832 篇相关文章

推荐文章7

LLM遇上表格:4类表示、5大任务、3大机会

文章指出LLM处理表格有任务单一、输入复杂易崩、表示不统一痛点,介绍4种表格输入表示法、5大任务,还发现任务复杂度、输入复杂度及表示统一方面存在新研究机会。

PaperAgent
开源动态7

AI图像水印失守!开源工具5分钟内抹除所有水印

一款名为UnMarker的去水印技术,能在5分钟内去除市面上几乎所有AI图像水印,谷歌HiDDeN已被完全破解,SynthID被攻破79%。它保持较高图像质量,已在GitHub开源,凭消费显卡可本地部署。

量子位
新闻资讯8

OpenAI惊人自曝:GPT-5真「降智」了!但重现「神之一手」,剑指代码王座

GPT-5发布后引发热议,其IQ测试成绩不佳遭吐槽,但实际是「路由」问题。解锁神GPT-5关键在prompt,医学家借它重现「神之一手」。它编程能力强,挑战Anthropic,还推动AI向「智能体式推理」发展。

新智元
算法论文8

X-Actor 惊艳登场!长时唇动+情感同步人像动画生成

字节提出 X - Actor,一个音频驱动自回归扩散框架,能通过一张静态参考图像和一段音频生成逼真、富有情感表达的人像动画视频。其核心是两阶段解耦生成流程,实现长时间唇形同步与情感音频一致性。

带你学AI
新闻资讯7

卡帕西点赞特斯拉餐厅,马斯克:兄弟,你再回来吧

特斯拉餐厅太火,原特斯拉AI大神Karpathy点赞,马斯克邀其回归。餐厅有机器人员工、超充电站,组合引关注。不过营业首日擎天柱出事故,且目前擎天柱发展混乱,马斯克却计划让它2026年当送餐员。

量子位
产品应用8

千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战

多模态大模型在多领域需求增长,但千卡 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。

InfoQ
开源动态7

从文本到3D动画:AnimaX重新定义3D动作合成方式

北航与清华推出3D动画框架AnimaX,结合视频扩散模型运动先验与骨骼动画可控性,让任意骨架3D角色自然动起来。其核心方法灵活控制动作,虽有局限,但为3D动画创作打开新局面。

带你学AI
新闻资讯7

复读一年,AI 把高考数学成绩从及格线提到 145 分!AI 数学能力发生了什么?

今年媒体让AI做高考数学题,Gemini 2.5 Pro获145分排第一。从去年到今年,AI数学能力指数增长,这得益于推理模型。推理模型用思维链和强化学习解题,未来高考数学或难区分模型能力。

宝玉AI
新闻资讯7

Vector数据库退位,AI记忆Memvid登场!

近期基于视频的AI记忆库Memvid大火,宣称革新AI记忆管理,能将文本片段存于MP4实现快速语义搜索。不过网友分析,它底层用FAISS,读写慢、文件大,仓库issues也显示其性能与声称相反。

PaperAgent
新闻资讯7

陶哲轩联手AI挑战经典ε-δ极限!加法秒杀、乘法翻车

数学大师陶哲轩第三支Lean 4自动化数学证明视频,携手GitHub Copilot挑战「ε - δ」极限问题。Copilot处理加法较顺,减法卡壳,乘法失控。复杂证明时它短板尽显,陶哲轩认为复杂证明还得靠人脑。

新智元