VLA大模型」共找到 9155 篇相关文章

开源动态8

破局模型训练黑盒,MegatronApp开源实现万亿参数「可视可控」训练

在2025上海QCon会上,算秩未来赵伯罕博士指出万亿级模型训练困境。上海期智研究院和算秩未来联合研发MegatronApp,以低入侵方式补齐链路,其四个模块形成闭环,让训练从黑盒变白盒,项目已开源。

InfoQ
算法论文8

AAAI 2026|AP2O-Coder 让模型拥有「错题本」,像人类一样按题型高效刷题

在AI辅助Coding技术发展背景下,开源语言模型生成代码有运行错误。上交博士团队提出AP2O方法,构建AP2O - Coder框架,借鉴人类学习模式,经实验验证能提升模型性能、抑制错误、提高样本效率,还适配通用模型

机器之心
开源动态8

模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
算法论文8

VLA统一架构新突破:自回归世界模型引领具身智能

北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。

机器之心
开源动态7

从社区数据出发,再看模型开源开发生态全景与趋势

蚂蚁开源先后在527蚂蚁技术日和外滩会发布模型开发生态开源项目全景图1.0和2.0版本。2.0版更新评估方法,呈现生态新变化,还分析技术趋势、开发者分布,提及项目进出情况及TensorFlow衰落等。

InfoQ
推荐文章7

本地LLM万字救场指南来了!全网超全AI实测:4卡狂飙70B模型

文章围绕本地语言模型(LLM)展开,针对实用性和经济性问题,用Dell Precision 7960塔式工作站对主流模型测试。涉及不同尺寸模型、推理框架等,给出不同配置下性能指标及使用建议,还模拟真实场景测试。

新智元
推荐文章8

模型推理加速全链路:内存管理、编译优化、量化与并行策略

本文整理自金煜阳博士在QCon会分享。介绍模型推理挑战,如规模增、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。

InfoQ
产品应用7

终于敢把真实地址、银行卡、种子词直接扔给模型

作者将真实个人信息扔给多个模型测试,结果模型收到的是脱敏后的占位符,OneAIFW 能自动完成敏感信息的占位和还原,本地完成操作,不留日志不上云,还介绍了使用方法和项目地址。

GitHubStore
新闻资讯8

LeCun赌上后半生,押注模型必死!Hassabis誓将Scaling进行到底

近日,「图灵奖」得主Yann LeCun炮轰硅谷主流AI路线,认为通过模型实现AGI完全是「胡扯」。DeepMind创始人Demis Hassabis则反驳,认为LeCun混淆概念。二者的争论折射出AI未来五到十年的方向抉择。

新智元
算法论文8

物理AI的「原生」时刻:原力灵机发布具身模型DM0

主流‘预训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出具身原生 VLA 模型 DM0。它能统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。

机器之心