「结构化图像」共找到 1538 篇相关文章
津渡生科邓司伟:「AI+生物制造」到底是什么?全链智能已经实现
当前生物制造迈向大规模工业化,AI深度介入。津渡生科邓司伟在大会指出,应构建全链路智能闭环,将AI渗透到发现、验证、生产三阶段,重塑工艺边界,实现专业经验去中心化。
一年前让英伟达蒸发6000亿,一年后被老黄搬上PPT
北京时间1月6日,黄仁勋在CES 2026上展示Kimi K2、DeepSeek V3.2、Qwen等中国模型。此前英伟达因谷歌、Meta等对手的冲击市值蒸发。老黄花200亿美元挖人,用中国开源模型反击,构建开放生态。
即时编程与设计,软件按需生成:Google生成式UI将重塑人机交互体验
Google Research团队发布生成式UI研究,打破Markdown文字墙模式,能将用户需求实时转化为完整应用程序。系统通过多组件协作,构建不同风格界面,在多领域有应用案例,虽有挑战但前景好。
爆火全网FLUX.2重磅上线,开源版Nano Banana来了!
Black Forest Labs的开源视觉模型FLUX.2上新,是专为现实创意工作流程打造的生产力工具。与前代相比,实现从「会画」到「懂你要画什么」跃升,还能在多方面保持一致性,各变体有不同定位与场景。
太炸裂了!全网实测Nano Banana Pro,网友:这模型里到底装了什么鬼东西!
谷歌Nano Banana Pro出世引发全网关注,它又名Gemini 3 Pro Image,整合多模态理解能力与知识库。普通用户可在Gemini应用免费体验,实测显示其实力强悍,还在网友手中玩出花,谷歌CEO也站台。
Nano Banana Pro上线!集成Gemini 3与Veo 3,谷歌不给竞争对手喘息机会
谷歌推出最强文生图模型Nano Banana Pro,又名Gemini 3 Pro Image,整合Gemini 3 Pro多模态理解能力与谷歌搜索知识库。它提升文字渲染等能力,支持多种分辨率和格式,还集成视频生成模型,覆盖多类用户。
机器人IRON被质疑是“真人秀”?小鹏一镜到底:七年打磨的行走答案
当IRON机器人被质疑“真人扮演”,小鹏一镜到底展示其内部结构。团队耗时七年打磨,实现轻盈稳定,其动作拟真度高模糊人机边界,是成功演示与公关案例。
AI 的本质不是算力,而是「上下文革命」
上交大刘鹏飞团队提出人工智能本质是“上下文革命”,在论文中把“上下文”提升为智能系统核心结构,提出“上下文工程”学科框架,通过实验揭示智能发展规律,为AI发展指明新方向。
NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!
继谷歌Banana后,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。
从0到1:天猫AI测试用例生成的实践与突破
本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。