全模态生成」共找到 3854 篇相关文章

开源动态8

500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

香港城市大学等团队发布图像 - 视频生成模型Pusa V1.0,在基础大模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力。

量子位
产品应用8

谷歌AI Studio大更新:推出新“vibe编程体验”,一键生成AI应用,好用到爆

谷歌AI Studio发布新vibe编程体验,可一键生成AI应用。基于Gemini API,启动界面有功能建议,还有“手气不错”按钮。构建问答游戏不到1分钟,免费且可编辑代码,还有AI建议功能,适合小白。

AI寒武纪
新闻资讯8

阿里安AGI一次发布3款LLM,8B多维度领先GPT-5.4

近期,阿里安AGI实验室发布3款Yuvion LLM,在AI安与内容安领域多维度领先。它以‘对抗即智能’为原则,构建五类数据体系,采用三阶段训练范式,通过YLRE四级评测体系验证能力。

PaperAgent
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
产品应用8

用DAA衡量智能体 百度智能云用“新栈”重新定义AI云|甲子光年

2026年产业焦点转向智能体落地,李彦宏提出DAA概念。百度智能云升级为新栈AI云,解决智能体落地难题,从架构决策、行业应用等多方面发力,其价值值得市场重估。

甲子光年
推荐文章7

5Y View|如何打造真正有用的AI产品?生成式AI改变的创业规则

本文围绕如何打造真正有用的AI产品展开,以Granola为例,阐述生成式AI领域创业需新打法,如不浪费时间解决即将消失的问题、利用边际成本创造机会、重视上下文及聚焦特定场景等。

五源资本 5Y Capital
算法论文8

一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26

VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,可按需生成3D场景,还能精准定位大模型空间推理缺陷。

量子位
产品应用7

Claude Opus 4.7,网差评!刚升级就翻车,用户怒斥:还我4.6

Claude Opus 4.7刚发布就遭网吐槽,价格贵50%,性能却严重倒退,出现幻觉、计算拉胯等问题。用户质疑Anthropic为省钱缩水模型,罪魁祸首可能是新引入的“自适应推理”功能。

新智元
产品应用7

AI陪伴Top 1应用上线视频生成!图片人物能说话唱歌,多轮对话场景依然稳定

AI陪伴应用Top 1的Character.ai(c.ai)上线视频生成功能AvatarFX,可让静态图片人物“开口说话”。c.ai还上新多项AI创作功能。此外,谷歌收购c.ai遭美国反垄断调查。

量子位