「选择性生成框架」共找到 3482 篇相关文章
实测 Google I/O 放出来的 Imagen4,不如GPT4o、甚至不如Imagen3。。
作者实测 Google I/O 推出的 Imagen4,发现它在生成封面图时审美和文字表达不佳。对比 Elo 评分及实际出图,在指令遵循、细节还原等方面,Imagen4 不如 GPT4o 甚至 Imagen3。
Anthropic 发布 AI Native 全流程实践指南
Anthropic应用AI团队发布实践指南,阐述如何将AI融入软件开发生命周期各环节。指出代码不再是瓶颈,构建快但周边流程慢。指南围绕六阶段展开,给出实施步骤、治理框架和度量指标。
AMI Labs 冯雁:AI 迈向现实世界,世界模型不可或缺 | ICML 2026
2026年7月7日,AMI Labs冯雁在ICML 2026带来特邀演讲,系统回答三个核心命题。她认为AI迈向现实世界,世界模型不可或缺,JEPA世界模型比生成式更具结构性优势,团队也取得系列关键突破。
真可用!美团数字人模型开源,MV、电商等统统拿下
美团开源数字人视频生成框架 LongCat - Video - Avatar 1.5 版本,换音频编码器、加速推理,支持多任务与多场景。经770人评测,它在多维度领先对手,各方面表现均衡,效率与质量兼得。
ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索器训练
在检索增强生成系统中,稠密检索器是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索器训练目标统一到语言建模框架,优势明显,实验效果佳。
仅保留35% Token,性能反超原模型!快手可灵等用视觉信息引导音频压缩,推理时间直降42%
Omni - LLM计算浪费严重,快手可灵等团队提出OmniSIFT框架。它利用音视频非对称依赖关系,通过时空联合剪枝压缩视频、视觉引导筛选音频Token,大幅减少Token数量,提升性能和推理效率。
拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式
使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。
比GenAI更大的机会
作者认为通用科学计算是比生成式AI更大的市场、机会,英伟达在该领域有统治地位,其竞争对手难以追赶。从市场本质、收入模式、护城河三方面分析,通用科学计算前景更优。
AI武装的黑产背后,这群人正在打一场看不见的战争。
文章揭示AI在黑产中的应用,如换脸、薅羊毛、钓鱼等,还介绍网商银行安全团队以攻为守的防御策略,像用AI生成验证码、检测行为特征,目标是抬高黑产作恶成本。
阿里新研究:统一了VLA和世界模型
阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。