新能安」共找到 7771 篇相关文章

产品应用7

AI生的图分图层,Agent控制力进入下半场

Lovart上线Layered Image Editing功,可自动识别图片里的文字、主体、背景并拆成独立图层,每个图层单独编辑。其还有快速模式,模型库更快,降低AI生图门槛。

探索AGI
算法论文8

模型「漂移」范式,何恺明作让生成模型无须迭代推理

训练生成模型复杂,传统扩散模型训练费时费力。何恺明团队提出「漂移模型」范式,不依赖微分方程,支持一步推理,实验验证其在多领域性佳,有望解决生成式AI质量与效率权衡问题。

机器之心
产品应用8

刚刚,MiniMax模型接管「音乐圈」!20秒出歌Cover全风格

4月10日,MiniMax带来重磅更,上线Music 2.6模型并发布专属Music Skills,核心Cover翻唱可自由进行风格置换。Music 2.6在速度、音乐性和音质上改进明显,还开放三个Music Skills套件。

机器之心
新闻资讯7

版GPT Image 2.5已经伪造GPT-6发布会了

GPT-6还未发布,版生图模型GPT Image 2.5就伪造其发布会。它升级幅度大,测试显示伪造奥特曼全员信等,在LMArena测试有生成快、图像逼真等特点,生图或成GPT-6主打功

量子位
新闻资讯7

晋诺得主警告:别做梦了,AI难有「经济奇点」!

晋诺奖得主Philippe Aghion早在2017年就剖析AI对就业与增长的影响,强调它并非奇点催化剂,而是受「鲍莫尔成本病」制约的工具。他认为AI是自动化进程的最形态,其对经济增长的促进作用或受限。

新智元
产品应用8

我用一张照片,生成了一个走进去的世界

斯坦福李飞飞创办的World Labs发布产品Marble,用一句话或一张照片就生成3D游戏世界,用户可自由探索。它降低3D建模门槛,提高影视游戏行业工作效率,潜力大但前景或取决于Token成本。

新智元
产品应用7

谷歌Gemini火力全开!实测:原生图像生成升级确实强

谷歌Gemini原生图像生成功升级,图像质量更好、文本渲染更准、生成速度更快。可融合图片元素、实时编辑等,免费试玩,开发者可集成API。实测表现惊艳,也有翻车情况,还搭配Gemini 2.5 Pro。

量子位
产品应用8

AI「解码」古罗马,重现千年铭文真相!DeepMind模型再登Nature

借助DeepMind推出的生成式AI工具Aeneas,考古学家面对古代碑文不再抓瞎。它是多模态生成式神经网络,助历史学家解读、归属和修复残缺文本,还可适应其他古代语言、文字和媒介。

新智元
算法论文8

告别无效计算!TTS框架拯救19%被埋没答案,推理准确率飙升

现有TTS方法存在路径同质化和中间结果利用不足问题。华为诺亚方舟实验室等机构提出SRCA框架,含检查点注入、答案聚类搜索和检查点候选增强组件,实验显示提升推理准确性、效率,降低成本。

机器之心
算法论文8

智源清华带来PAM,手物交互数据生成SOTA | CVPR 2026

北京大学、清华等联合提出统一引擎PAM,整合姿态、外观和运动。用户提供初始和目标姿态及物体几何形状,它就生成逼真手物交互视频。其效果超现有方法,合成视频可用于数据增强。

AI科技评论