全景图像生成」共找到 2448 篇相关文章

算法论文8

北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景

北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务等成完整技术链路,还通过实验等给出实践指南。

量子位
算法论文8

让大模型基于「图像事实」说话:用事实文本+自适应编辑,让语言偏见无处遁形丨ICLR'26

多模态大模型看图常“脑补”,存在对象幻觉问题。北航团队提出AFTER框架,含FAS和QAO模块,能在主流LVLM和基准上显著降低幻觉,且推理开销低,为多模态助手落地提供实用路径。

量子位
算法论文8

从视觉出发统一多模态!颜水成团队最新研究:不再把图像编解码器塞进LLM|ICLR'2026

NVIDIA研究员Jim Fan称AI正经历第二次预训练范式转移。颜水成团队Muddit模型从视觉先验出发,用离散扩散框架统一文生图、图生文和VQA,挑战多模态“语言中心论”,在多任务表现出色。

量子位
产品应用7

重磅!谷歌开放世界模型Genie 3试用:AI实时生成可玩世界,人人都能创造“我的世界”

谷歌开放世界模型Genie 3实验性研究原型Project Genie试用,美国18岁以上Google AI Ultra订阅用户可体验,能创建、探索和重混互动世界,不过Genie 3是早期研究模型,有待改进之处。

AI寒武纪
开源动态8

兄弟们,人都麻啦,网站克隆+AI生成前端,又一个卷王项目,这叫我还怎么卷啊!!!

Open Lovable由Firecrawl团队开源,输入网站URL,AI就能将其转换为可运行的React/Next.js应用。项目亮点是开源、支持多AI提供商等,可解决原型开发、旧站迁移等痛点。

小华同学ai
开源动态8

代码生成要变天了?被质疑架空后,Yann LeCun携320亿参数开源世界模型“杀回来了”

美国当地时间9月24日,Yann LeCun团队发布320亿参数代码世界模型CWM。它创新训练方式,能模拟代码执行。性能测试表现出色,还开放检查点。Meta AI业务重组,CWM发布或表明未彻底放弃开源。

InfoQ
产品应用8

16 年老程序员用 Claude Code 搞副业:我只手敲了 1000 行,剩下 95% 代码靠自动生成

Anthropic公司的AI编码助手Claude Code推出4个月吸引11.5万开发者,单周处理代码量达1.95亿行,预估年化收入约1.3亿美元。开发者Indragie用其构建macOS应用,2万行代码中手写不到1000行,还分享使用技巧与体验。

InfoQ
开源动态8

一文看懂 TritonNext 2026:FlagOS 亮点详解、语言扩展新趋势、AI 生成更加“底层”、芯片软件生态或迎“新拐点”!

1月9日,「2026 TritonNext技术大会」召开,专家探讨AI编译器等最新解法。如林咏华介绍FlagOS v1.6应对生态难题;崔慧敏用“AI for Compiler”破芯片演进难题;上海人工智能实验室推出DLCompiler打破算子开发困境等。

AI科技大本营
开源动态8

3D指标超过Nano Banana Pro!浙大开源方案让AI在平面图像里进行立体编辑 | ACM MM'26

当前图像编辑模型处理三维状态常出错。浙江大学ReLER团队提出并开源PhyEdit,用显式3D几何preview指导图像编辑,还加入深度监督,构建数据集和评测基准,成绩超Nano Banana Pro,且GUI也开源。

量子位
产品应用7

宇树新机器狗太猛了!1米高石阶轻松爬,越野快到出残影,网友:这不是AI生成的???

宇树新机器狗Unitree A2星际猎影实力惊人,全视频无加速展示跑酷、爬山等技能。它有超广角激光雷达3D感知系统,能自主避障,还很轻、强、快,承载能力佳,官方未公布售价和上市日期。

量子位