「高分辨率三维形状」共找到 155 篇相关文章
GPT-5.4据传下周上线!200万上下文窗口+持久化状态,告别频繁遗忘
OpenAI工程师在GitHub仓库意外泄露GPT - 5.4,相关信息流传后被撤回。据传下周上线,其有200万Tokens上下文窗口与持久记忆,支持全分辨率视觉直读,将引发硬件内存之战。
华中农大“魔改”芯片电镜,揭示共生固氮暗藏百年的秘密
华中农业大学苏超和刘培文教授团队“魔改”芯片电镜,构建三维显微观测系统,揭示根瘤菌进入宿主细胞路径,发现果胶裂解酶作用,该技术在植物科学属首次应用,有望助农业减氮肥。
数学大佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?
菲尔兹奖级纯数学成果落地大模型训练。佛罗里达大学团队用三维挂谷猜想解决大模型“黑盒问题”,GeoLAN加几何约束,效果显著。菲尔兹奖得主Jacob将入职OpenAI,AI在数学领域成果频出。
它来了!Context Engineering 2.0
SJTU、SII和GAIR新作《Context Engineering 2.0:The Context of Context Engineering》探讨上下文工程,回溯其30年历史,给出形式化定义,提出采集 - 管理 - 使用三维设计范式,还介绍了应用场景。
谷歌Veo 3.1更新:更一致性、更具创造力和控制力
谷歌Veo 3.1发布更新,实现角色、背景与物体在动态场景中的高度一致性,支持基于参考图片创建视频、原生竖屏模式及1080p和4K分辨率升频,精准控制素材,提升创作体验。
ICML 2025 Spotlight|南洋理工陶大程教授团队等提出基于RAG的高分辨率图像感知框架,准确率提高20%
南洋理工陶大程教授团队等合作,为解决多模态大语言模型处理高分辨率图像问题,探索 RAG 应用可行性,提出 Retrieval-Augmented Perception (RAP) 框架,在多任务上提升性能,已被 ICML 2025 接收。
GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”
多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。
清华唐杰团队揭示大模型记忆全景
清华唐杰教授团队等发布大模型记忆架构综述,提出三维记忆分类学,将前沿工作统一到理论框架,为LLM设计指明方向,分析了隐式、显式记忆架构,还探讨混合架构挑战与未来方向。
清华突破「光毒性」难题,活体显微进入无扰观测时代
清华大学团队研发出LF-denoising自监督去噪算法,可在超低光毒性下实现长时间高保真三维亚细胞成像,突破了长时间活体成像的光毒性限制,为多领域研究提供新工具。
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026
过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。