连续潜空间」共找到 602 篇相关文章

算法论文8

让大模型“边看边改”,视觉分割准确率直接上涨9% | ICML 2026

复旦、创智联合推出RSAgent,让多模态大模型通过多轮工具调用生成准确掩码,解决视觉分割难题。该工作入选ICML 2026,实验显示其在多个测试集上表现领先,还展示了从‘看图问答’到‘视觉行动’的路径。

量子位
开源动态8

鹏城实验室 X 中大hcp实验室推出 RADAR : 具身智能评测的新标杆

RADAR是鹏城实验室与中大hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三大缺陷,通过创新设计揭示模型不足,为研究者提供方向,推动具身智能实用化。

AI科技评论
算法论文8

斯坦福×英伟达发布AI推理新范式,刷新了多领域SOTA

斯坦福与英伟达联合发布论文 TTT - Discover,提出新范式,不追求通用,在推理阶段针对特定难题修改模型参数。它战绩辉煌,但成本高、是偏科生且需打分器,其出现是技术与哲学的突破。

新智元
算法论文8

浙大彭思达团队 × 理想最新研究:直面高分辨率深度的细节缺失

现有高分辨率深度估计方法在实际使用中存在局限,浙江大学彭思达团队联合理想研究团队提出论文《InfiniDepth: Arbitrary-Resolution and Fine-Grained Depth Estimation with Neural Implicit Fields》,构建实验验证了InfiniDepth在多方面的有效性。

AI科技评论
新闻资讯7

上海首场!一场专为女性设计的黑客松

上海将举办首场专为女性设计的黑客松「She Code Lab Hackathon」NO.C001,时间为2025年12月26 - 28日。活动约50 - 100人规模,由女性主导,核心是‘表达’与‘联结’,主题为‘利她技术’。

MANA新媒体艺术站
算法论文8

何恺明团队重磅新作:去掉VAE,无需Tokenizer,纯Transformer预测数据比预测噪声更高效

麻省理工学院何恺明团队发布颠覆性研究,指出主流扩散生成模型未做好去噪工作,回归洁净数据预测才是高维像素生成正解。团队设计实验验证观点,提出极简架构JiT,展现优越性能与扩展能力。

AIGC开放社区
新闻资讯7

AI正在改写地图APP!这一次轮到谷歌了

谷歌让开发者可通过Gemini API调用谷歌地图工具,整合位置感知功能。支持多模型,按查询次数收费。玩法多样,能个性化、实时化处理需求。国内高德早有相关尝试,AI正改写地图APP。

量子位
产品应用7

Thinking Machines 发布 Tinker,重新定义 LLM 微调的边界

Thinking Machines 发布工具 Tinker,它是灵活的语言模型微调 API,采用‘责任分工’模式,让研究者专注算法创新,不用被运维细节拖累。此模式获 Karpathy 赞赏,目前 Tinker 开始内测,理念受欢迎。

AI工程化
新闻资讯7

OpenAI宋飏被Meta挖跑了!扩散模型崛起关键人物,加入MSL再会师清华校友赵晟佳

最新消息,扎克伯格从OpenAI挖走华人研究员宋飏。他是扩散模型崛起关键人物,曾带队OpenAI战略探索团队。在OpenAI他成果显著,其研究或终结扩散模型。现加入Meta MSL,与清华校友赵晟佳会师。

量子位
新闻资讯7

王兴兴回应比赛风波:挣到钱了,但现在的机器人别指望它能干活

2025北京智源大会上,宇树科技王兴兴、北京人形机器人创新中心熊友军等围绕具身智能探讨。提到机器人赛事能展示成果、促进行业发展;对机器人构型看法不一;还探讨了VLA泛化性等问题。

AI前线