视觉质量」共找到 1246 篇相关文章

推荐文章7

00后女生躲进房间造梦:我想让1000个焦虑的人,变成一只轻盈的蝴蝶

00后女孩陈栩乐是深耕VR交互领域的创作者。她以蝴蝶为具身载体,打造VR疗愈作品《Crossing the Senses》,用点云视觉呈现自然能量交换。创作中AI助力破技术难题,她追求轻交互疗愈。

MANA新媒体艺术站
新闻资讯7

The Batch: 938 | Gemini 的音乐生成器

Google将音乐生成器Lyria 3加入Gemini和YouTube,它接收文本或图像生成30秒音频,支持多语言歌词。在质量和遵循提示上优于前身,采取版权保护措施,对特定用户免费或提供高额度使用。

DeeplearningAI
产品应用7

我复刻了 Claude 刚发布的生成式 UI 交互!

Anthropic在Claude上线基于生成式UI的新交互,作者复刻该功能到Code Pilot。介绍其多种玩法,如数据分析、制作小工具等,还阐述实现过程与体验打磨细节,保证生成式UI视觉稳定。

歸藏的AI工具箱
推荐文章8

95 后团队做 3D 大模型,拿下头部游戏重磅合作,正在定义 3D 生成的新规则

影眸科技年轻团队携 3D 生成模型 Rodin 获头部游戏合作。其研究入选 SIGGRAPH 最佳论文提名,还完成融资。新模型 Rodin Gen - 2 提升生成质量与可控性,在多领域应用,定义 3D 生成新规则。

Founder Park
产品应用7

Alibaba力作:Ovis-U1 融合理解、生成与编辑,解锁无限可能

OpenAI 2025 年推出的 GPT - 4o 结合图像与语言能力,但引发视觉解码器设计及统一模型训练问题。Alibaba 力作 Ovis - U1 单一模型能完成理解、生成与编辑任务,介绍了其架构、训练过程和应用。

CourseAI
新闻资讯7

那位曾高喊「AI能接管一切」的CEO后悔了:宣布重启人工招聘!

Klarna CEO曾称AI能取代所有人类工作,公司也实施‘AI优先’战略,用AI客服取代人类、缩减人力。但AI客服实际表现不佳,服务体验差,Klarna决定重启人工招聘,打造‘高质量人类支持’。

AI科技大本营
算法论文8

治好多模态近视和走神!上海大学去偏干预显著提升模型性能

多模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区
新闻资讯7

CEO 刚离职,GitHub 就瘫了?!程序员“乐土”没了,4年CEO自曝在微软受限干不下去,被开发者骂蠢喊冤

当地时间8月11日,GitHub首席执行官Thomas Dohmke宣布辞职,次日GitHub搜索出现故障。微软收购GitHub后,其将更全面融入微软架构,不再设单一领导者。Dohmke自曝受限多,他认为未来Agent代码质量或超人类。

InfoQ
算法论文8

清华联手英伟达打造扩散模型新蒸馏范式!视频生成提速50倍,4步出片不穿模

清华大学朱军教授团队与NVIDIA Deep Imagination研究组联合提出分数正则化连续时间一致性模型(rCM),将连续时间一致性蒸馏扩展至大模型,解决现有方法瓶颈,提升推理速度兼顾质量与多样性。

量子位
新闻资讯7

同行评审濒临崩溃!一篇审稿报告450美元?科学家不再愿意「用爱发电」

同行评审面临劳动力短缺困境,申请者互评成热门方案。该系统还存在研究质量下滑、创新想法被埋没等问题。为解决问题,人们尝试付费审稿、提供评审指南等,也有人建议彻底改革或废除。

新智元