「反事实图像」共找到 666 篇相关文章
Google DeepMind CEO Hassabis 最新访谈:未来十年实现完整 AGI,引领科学黄金时代
Google DeepMind CEO Demis Hassabis在访谈中分享诸多观点。他认为未来十年能实现完整AGI,还谈到Genie 3重新定义视频、人形机器人重要性等,指出AI创造力不足等局限,也提及旗下公司在制药等领域突破。
「CV 铁三角」落定Meta,视觉 AI 如何向多模态演进?
Meta 高薪挖来「CV 铁三角」引关注,其研究成果与视觉 AI 向多模态演进路径高度贴合。他们过往十年协作,研究涵盖 S4L、BiT、ViT 等,构建起现代多模态 AI 基础框架。
从「塑料人」到「有血有肉」:角色动画的物理革命,PhysRig实现更真实、更自然的动画角色变形效果
当前主流绑定技术LBS有体积丢失等问题,影响动画真实感。UIUC与Stability AI联合提出PhysRig框架,用可微分物理模拟实现更真实自然的动画角色变形,还能做动作迁移,未来将开源并封装为插件。
何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升
何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。
医学领域也有世界模型了:精准模拟肿瘤演化,还能规划治疗方案
来自多机构学者联合提出医学世界模型(MeWM),赋予AI“预演”疾病发展的能力。它能模拟肿瘤演化,为个性化治疗提供辅助,有肿瘤演变模拟、生存风险预知和临床决策闭环三大核心功能。
字节开源了一个了不得的模型!
字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试有亮点但效果不稳定,还分享该模型体验Demo、地址及安装使用教程。
AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退
Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。
鹅厂员工都是怎么被AI“糊弄”的?
文章邀请鹅厂同事分享被AI“糊弄”的离谱事件,如AI在发票报销、数学计算、编程问题等方面出错,还会编造不存在的信息,其“系统性可信”假象比单纯答错更危险。
AI 是设计工具的顺风还是逆风?
在生成式AI影响下,Figma曾被视为「AI输家」,但2026年第一季度营收同比增长46%。其联合创始人兼CEO Dylan Field称,AI是业务扩张核心驱动力,强调设计价值在不可被AI标准化领域。
微软 SkillOpt:不动模型权重,只训练那份「技能说明书」
微软研究院 Yifan Yang 等人推出 SkillOpt,思路反直觉,不动模型权重,把「技能文档」当可训练参数。它在 52 个组合中表现最优,技能可迁移,代码已开源,还支持多操作。