高质量输入」共找到 2440 篇相关文章

算法论文8

西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026

AI 视频生成目前存在长视频稳定性问题,西湖大学张驰团队提出 《Free-Lunch Long Video Generation via Layer-Adaptive O.O.D Correction》。研究表明 FreeLOC 方法能提升长视频生成质量,且具跨模型通用性,还揭示了问题机制,降低算力成本。

AI科技评论
开源动态8

一张图0.1秒生成上半身3D化身!清华IDEA新框架入选ICCV 2025

清华和IDEA研究人员提出新框架GUAVA,可0.1秒从单图创建上半身3D化身。它解决了现有方法在ID一致性、效率等方面的局限,实验显示其在渲染质量和效率上优于现有2D和3D方法,代码已开源。

量子位
新闻资讯8

刚刚,Opus 5来了:性能不输 Fable 5、价格砍半

Anthropic 发布新一代模型 Claude Opus 5,其智能接近 Claude Fable 5 但价格减半。它在编程、知识工作等评测中表现出色,科研能力进步大,自主性与严谨性更强,安全对齐度,防护兼顾安全与可用。

机器之心
新闻资讯8

Claude Design连夜突袭,Figma市值瞬间蒸发!或抢走全球UI设计师饭碗

Claude实验室推出Claude Design功能,只需输入一句话就能生成可交互完整原型,让Figma等设计公司股价跳水。它或让画图动作消失,引发对设计师职业是否会被取代的思考,Anthropic还在下更大的棋。

新智元
开源动态8

腾讯混元开源世界模型!2.0版本一键生成3D空间,游戏关卡随心造

4月16日,腾讯正式发布并开源混元3D世界模型2.0(HY - World 2.0)。它是多模态模型,能理解多种输入,自动生成、重建和模拟3D世界,支持多格式3D资产导出,可与游戏工作流对接。

量子位
算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。

机器之心
产品应用7

亿级日活App的“算力生死劫”:推理成本倒挂,他们靠跨云架构砍掉75% GPU集群

一家AI穿搭+购物推荐的出海应用DAU破亿,但算力和传输成本,ARPU远低于成本。该企业转向Akamai推理云,换用RTX PRO 6000,缩减服务器集群,降低成本,采用跨云架构过渡,实现零阵痛平替。

量子位
产品应用8

AI公司烧不起Token了!国产Agent杀出,逼近Opus 4.6还免费

Token成AI时代“电力消耗”,企业成本压力大。昆仑万维推出性能Agent模型SkyClaw - v1.0及轻量版,性能逼近顶流,价格低且限时免费。经实测能力强,其训练体系独特,未来还将开源。

新智元
新闻资讯8

刚刚,「欧洲的DeepSeek」发布Mistral 3系列模型,全线回归Apache 2.0

Mistral AI发布Mistral 3系列开放模型,含Ministral 3和Mistral Large 3,均采用Apache 2.0许可证。该系列模型性价比,性能出色,还与多方合作。其发布或标志欧洲重返AI竞赛,也是对DeepSeek的追赶。

机器之心
推荐文章7

团队授权:分散化的架构决策

文章以黏菌创建网络为隐喻,探讨软件团队去中心化架构决策。介绍转型历程,包括重组团队、建立建议流程、创建上下文图等,阐述各环节作用、挑战与收益,强调其能提升决策质量与团队参与度。

InfoQ