「谷歌Veo 3」共找到 2684 篇相关文章
你和ChatGPT的私密对话正在全网裸奔!网友炸锅:我把ChatGPT当知己,它却把我隐私挂网上
近日,谷歌搜索惊现4500条ChatGPT对话,其中含大量用户深层个人信息。OpenAI称是用户主动分享致索引,将移除该功能并清理。但聊天记录仍在其他搜索引擎现身,引发网友质疑。
半数清华,8位华人AI天团集体投奔Meta!奥特曼:砸钱抢人不如培养死忠
硅谷人才争夺战升级,Meta砸3亿美元疯狂挖角,众多核心研究员投奔。OpenAI则推进‘驻留计划’,培养跨界人才,成本低、能植入文化、忠诚度高,这场人才战影响AGI时代走向。
AI玩拼图游戏暴涨视觉理解力,告别文本中心训练,无需标注的多模态大模型后训练范式
在多模态大模型后训练浪潮中,现有方法多以文本为中心。MMLab@南洋理工大学提出Visual Jigsaw,将拼图任务用于后训练,让模型不依赖标注强化视觉感知与理解,在图片、视频和3D模态验证有效。
视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒
谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。
从「片段生成」到「长视频漫游」:OmniRoam探索轨迹可控的长视频生成新范式
在生成式视频发展中,长时序视频生成面临挑战。研究者提出 OmniRoam 新方法,通过全景表示和分阶段生成框架,提升视频时空一致性,还构建数据评测体系,实验表现优,有效率和 3D 应用潜力。
库里被「采访」、杨紫被「演」短剧?别慌!蚂蚁AI鉴真拿下CVPR 2026冠军,专治黑产
深度伪造技术滥用,明星成换脸受害者,引发社会关注。蚂蚁集团AI安全实验室队伍MICV获CVPR 2026挑战赛冠军,还发布检测资源仓库。团队提出基于DINOv3的框架,解决AIGC检测难题,成果显著。
刚刚,OpenAI发长文:找到缓解LLM撒谎的方法!
Google发布Gemini 3 Deep Think,ARC - AGI - 2准确率高且采用并行推理技术。OpenAI发长文《通过忏悔训练大型语言模型诚实性》,介绍缓解LLM撒谎的忏悔训练法、实验结果等,也指出其局限。
Nano Banana Pro或将引爆新安全危机
基于Gemini 3的图像生成模型Nano Banana Pro昨日上线,支持2K/4K分辨率生成,排版和文字控制能力提升。它展现出复杂推理能力,能理解反光、推理指纹,但这或带来隐私危机。
iPhone 17牙膏挤爆,却没挤出AI!苹果再演诺基亚宿命?
苹果9月推出iPhone 17,其AI功能多是辅助或后台改进,未彻底颠覆体验。谷歌、OpenAI在AI布局领先。AI将重构手机产业,产业链面临洗牌,苹果若不重视AI,可能重蹈诺基亚覆辙。
Isomorphic Labs:DeepMind 创始人再创业,打造制药界的 TSMC
Isomorphic Labs 由 Alphabet 拆分 DeepMind 生命科学团队而来,用深度学习加速药物设计。借 AlphaFold 3 将药物发现转向 AI 驱动,与药企合作获数据和收入,有望成药物研发‘AI Foundry’,但也面临挑战。