海外训练模型」共找到 8265 篇相关文章

开源动态8

MeshCoder:以大语言模型驱动,从点云到可编辑结构化物体代码的革新

生成式AI在三维空间面临挑战,传统3D生成成果粗糙难编辑。团队推出MeshCoder,将三维输入翻译成结构化代码,有分部件生成等优势。介绍其实现路径、实验性能,也指出局限并展望未来。

机器之心
新闻资讯7

6位前DeepMind老将打造「AI指挥官」,一半成本刷新SOTA

6名前Google DeepMind成员创立Poetiq,搭建元系统让前沿大模型自动生成解决特定任务的策略和模型组合,降低推理成本。其Gemini 3 Pro优化技术在ARC - AGI - 2上创SOTA,成本仅为之前最优方法一半。

新智元
算法论文8

清华联手快手可灵,撞车谢赛宁团队RAE,用SVG再证明VAE已过时

AI图像生成正告别VAE技术。清华与快手可灵联合提出SVG方案绕开VAE,纽约大学谢赛宁团队也提出RAE模型。SVG用自监督特征构建潜空间,在质量、效率和通用性上超传统,证明统一视觉模型可行。

AIGC开放社区
算法论文8

BIGAI & 中科大团队提出 MILR: 测试时隐空间推理,让图像生成学会「边想边改」丨ICLR 2026

BIGAI与中科大等团队提出MILR,通过测试时隐空间推理,在不更新模型参数下优化图文表示,提升复杂图像生成能力。该方法在多基准测试达SOTA,还探讨了测试时扩展与奖励模型,未来有诸多拓展方向。

AI科技评论
推荐文章7

AI领域并无真正的新想法,只有新的数据集

作者Jack Morris认为AI虽进步明显,但范式转变级突破不多。大语言模型四次关键突破底层理论早已有之,新在于数据。改变数据比调整模型或算法作用更明显,推动AI进步应找新数据,如YouTube或具身化数据。

宝玉AI
新闻资讯7

具身进化·无界未来:这场论坛引领具身智能模型革命新浪潮

5月29日,2025张江具身智能开发者大会相关论坛举行,汇聚专家探讨热点话题。张江集团推动产业发展,多位嘉宾分享成果与思考,圆桌对话也各抒观点,为具身智能发展描绘蓝图。

机器之心
算法论文8

ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点

Doc-V*由小米和华中科技大学团队提出,是多页文档理解新范式,通过交互式视觉推理让模型有策略地读长文档。它在多页文档问答基准上比RAG变体提升49.7%,不依赖大模型或长上下文窗口。

机器之心
算法论文8

田渊栋:连续思维链效率更高,可同时编码多个路径,“叠加态”式并行搜索

AI大牛田渊栋团队利用连续空间“叠加态”让大模型并行推理,提升图可达性等任务表现,为连续思维链提供理论支持。还设计注意力选择器等机制,实验显示连续思维链模型准确率更高。此外,田渊栋还是科幻小说家。

量子位
新闻资讯8

突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达

OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。

机器之心
产品应用8

AI Coding新王登场!MiniMax M2.1拿下多语言编程SOTA

MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务中表现出色。

量子位