视频预训练」共找到 3048 篇相关文章

8

马斯克「开颅插针」首破1.5秒!上万人挤爆,争当赛博格

Neuralink放出20分钟视频,联创阐述最新进展。手术机器人将单根电极植入时间从17秒降至1.5秒,植入深度超50mm。全球超万人排队,公司计年底前20位患者完成手术,愿景是增强人类认知。

新智元
开源动态8

英伟达巧用8B模型秒掉GPT-5,开源了

英伟达携手港大开源Orchestrator-8B小模型,在HLE测试中分数超GPT - 5,成本低且速度快。它靠ToolOrchestra训练法,协调工具解题。此赛道已有多项研究,小模型实用优势明显。

量子位
新闻资讯8

谷歌新架构突破Transformer超长上下文瓶颈!Hinton灵魂拷问:后悔Open吗?

谷歌在NeurIPS 2025发布两项大模型新架构研究,通过‘测试时训练’机制,推理阶段可将上下文窗口扩展至200万token。新成果Titans和MIRAS结合RNN速度与Transformer性能,突破超长上下文瓶颈。

量子位
算法论文8

四足机器人首次同时「思考+走路」,北大提出链式推理MobileVLA-R1

在「大模型+机器人」浪潮中,让机器人既听懂话又走得对、稳很难。北大MobileVLA - R1将链式思考引入四足机器人,在仿真和真实实验中对标强基线实现提升,构建了更具工程可用性的范式。

新智元
开源动态8

一个模型读懂所有医学数据,Hulu-Med探索医学大模型开源新范式 | 浙大x上交xUIUC

Hulu - Med是浙大、上交、UIUC等联合提出的通用医学视觉语言大模型,首次在单一模型统一理解医学多类数据。它开源透明,训练成本低,性能媲美GPT - 4.1,为医学AI带来新范式。

量子位
新闻资讯7

一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”

NVIDIA 推出多模态大模型 OmniVinci,结合架构创新与合成数据流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发“假开源”争议。

InfoQ
产品应用8

机器人“会用手”了!银河通用首破手掌任意朝向旋转难题,拧螺丝、砸钉子样样精通

银河通用推出的灵巧手神经动力学模型DexNDM,让灵巧手实现从能动到能用的飞跃。它首次突破手掌任意朝向旋转难题,实现跨物体、跨姿态稳定操作,助力机器人迈向精细操作,推动灵巧操作走向生产力基础设施。

量子位
产品应用8

钉钉不说话,默默把 AI 表格干到了 1000 万热行

钉钉 AI 表格单表容量突破 1000 万热行,成业内首个实现该能力的智能表格。它基于阿里 AI 技术重构底层架构,实现性能与智能融合,在业务场景应用效果好,推动 AI 办公进入‘原生时代’。

MacTalk
新闻资讯8

谷歌首次曝光太空AI计划:要建“AI版星链”,AGI的终极基础设施?

谷歌曝光Project Suncatcher计划,要构建太空AI计算集群。此设想是部署卫星星座建“太空数据中心”。虽面临诸多挑战,但从物理学和经济可行性看并非遥不可及,谷歌已发表相关印本论文。

AI寒武纪
产品应用8

当搜索遇见 AIGC:京东零售的“千人千面”素材生成实践

在 AIGC 浪潮下,视觉生成技术重构电商生态。京东零售李岩介绍“千人千面”商品素材生成技术链路,包括关键模型及实现框架,还发布焕新版京点点平台并告新能力,推动电商个性化变革。

InfoQ