能碳产业大模型」共找到 10306 篇相关文章

算法论文8

物理AI的「原生」时刻:原力灵机发布具身大模型DM0

主流‘预训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出具身原生 VLA 模型 DM0。它统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。

机器之心
新闻资讯7

狂拿大模型明星订单,一家清华系HPC-AI Infra公司浮出水面

本文介绍清华系计算创业公司是石科技,其93年创始人闫博文不囤算力仍拿下大模型明星公司订单。团队技术实力强,3次获戈登·贝尔奖。公司构建全栈力,为多领域提供服务,未来想以算力赋各行业。

量子位
开源动态8

Apple | 开源视觉语言模型:FastVLM,可手机运行,首token速度提升 85 倍

苹果开源在 iPhone 上运行的视觉语言模型 FastVLM,代码仓库含 iOS/macOS 演示应用。它解决体积和速度问题,首 token 输出速度提升 85 倍,引入 FastViTHD 编码器,适配 iOS/Mac 生态,有不同参数量级版本。

AINLPer
算法论文7

ICML'25 | 告别手动SFT!一句话得到你的专属大模型LoRA

传统微调方法开销大、部署难,Text-to-LoRA (T2L) 框架应运而生。它基于自然语言指令对 Transformer 模型即时适配,有三种架构变体,采用两种训练方法,实验显示其在多维度表现有效。

PaperAgent
新闻资讯7

征集全国首部AI大模型私有化部署标准起草单位和个人!

智合标准中心组织起草国内首部AI大模型私有化部署标准《人工智模型私有化部署技术实施与评价指南》,已正式立项并征集起草单位和个人。该标准解决企业部署痛点,有全流程覆盖等亮点。

AI工程化
算法论文8

强化学习+大模型记忆:Mem-α,让智体第一次学会“如何记忆”

在大语言模型发展中,‘记忆’是智体具备长期智的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,在性、泛化等多方面表现出色。

机器之心
开源动态8

谷歌让机器人「长脑子」了!首发离线具身VLA模型,断网精准操控

谷歌首发具身智离线模型Gemini Robotics On-Device,实现VLA多模态大模型在具身机器人本地离线运行,无网络也稳定运行。谷歌还开源了SDK,具身智迈向实用化新阶段。

新智元
算法论文8

破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%

来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。

机器之心
开源动态8

不止于快!美团新推理模型正在重新定义「实用主义AI」

美团发布并开源推理模型 LongCat-Flash-Thinking,它在权威测评表现突出。该模型有多项创新,更快、更干、更可靠。其将技术实力转化为业务服务力,实战测试表现佳,体现美团实用主义 AI 路径。

InfoQ
开源动态8

单卡搞定万帧视频理解!智源研究院开源轻量级超长视频理解模型Video-XL-2

智源研究院联合上海交通大学等机构发布新一代超长视频理解模型Video-XL-2。它单卡处理万帧视频,编码2048帧仅需12秒,在效果、长度和速度上全面优化,已开放模型权重。

量子位