「VLA大模型」共找到 9349 篇相关文章
ACL2025 | 传统符号语言传递知识太低效?探索LLM高效参数迁移可行性
中科院自动化所谭宇乔等研究跨规模大模型参数知识迁移(PKT)可行性。指出传统符号语言传递知识低效,LLM 模仿此范式也有局限。提出新 Pre - Align PKT 范式,实验分析 PKT 效果,揭示神经不兼容性致其失败。
Skywork AI | 发布Super Agent,一站式搞定写作、开发、分析与创意内容生成
去年谷歌定义了Agent,如今随着大模型发展其能力升级。Skywork AI推出Super Agent平台,有5个专家AI agent和1个通用AI agent,能生成多类型内容且支持溯源。它突破行业瓶颈,还开源相关框架和MCP。
从一行代码发现DeepSeek的秘密:Model1到底是什么?
在DeepSeek - R1发布一周年时,有人在GitHub的FlashMLA代码仓库发现神秘代号Model1,可能是V4。文章分析了代码仓库用途、新模型“露馅”原因,还从代码中发现Model1细节,结合论文梳理时间线,最后也提出了怀疑。
Codex负责人打脸Cursor CEO“规范驱动开发论”!18天造Sora爆款,靠智能体24小时不停跑,曝OpenAI狂飙内幕
本文围绕OpenAI的编程智能体Codex展开,介绍其用户增长、技术突破、应用场景等情况。Codex负责人认为真正的智能体由模型、API和框架构成,它让Sora安卓应用快速上线。还谈及OpenAI文化、AI未来及对工程行业的影响。
5Y View|Bill Gurley:AI浪潮如何重塑一级市场结构
知名风投大佬Bill Gurley指出,超级风投基金崛起催生“僵尸独角兽”,零利率使IPO和并购停滞,LP面临流动性问题。AI浪潮打断市场修正,带来投资热潮和估值泡沫,多数AI企业营收靠算力转售。他还看好中国开源AI模型发展。
三榜第一,完胜GPT-6!中国物理RSI杀出黑马
中国AI公司诺因发布面向家庭机器人的生成式学习框架GLOW,以原生自回归架构+RSI递归自我改进机制,在三大机器人任务榜单拿下第一,性能远超GPT-6 Astra,主打人类示范一遍就能泛化执行,计划明年推出家庭机器人X1。
Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃
大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。
Wan3.0正式上线千问AI平台:稳定、真实、有质感
今天,视频生成模型Wan3.0正式上线千问AI平台。它在多维度全面升级,公测以来收到大量反馈,获创作者、企业用户等好评。在多领域经检验表现出色,还持续进化,部分API限时7折,已被多平台接入。
告别App孤岛,天翼AI如何用统一入口重构数亿用户的数字生活?|甲子光年
2025年中国AI行业模型能力强但用户体验复杂,存在数字鸿沟。中国电信在数智科技生态大会上,天翼AI发布星辰智能体服务平台1.0,以统一入口“星小辰”智能体重塑入口逻辑,还在多领域布局扩张能力。
英伟达拟 10 亿美元砸向这家 AI 编码创企!Copilot 技术大佬带队、成立两年估值近千亿
10月30日彭博社报道,英伟达拟最高投10亿美元给AI创企Poolside,此轮融资或使其估值翻四倍。该公司由微软技术大佬带队,开发AI编码助手,创建强化学习法训练模型,从底层自研,有独特优势。