「优化训练」共找到 3104 篇相关文章
怎么量化机器人数据价值?ATHENA将影响函数扩展到十亿参数VLA,313×加速筛选高价值数据
具身智能进入数据scaling时代,VLA模型训练中数据并非越多越好。上海交大同济等校团队提出ATHENA框架,将影响函数扩展到十亿参数VLA模型,解决计算和筛选难题,实现313倍加速,实验证明其用更少数据获更好效果。
李飞飞 、 英伟达 Jim Fan 、徐丹飞三巨头联合重磅论文,改写灵巧手触觉赛道
近日,李飞飞、英伟达Jim Fan等顶尖学者联合发表论文《T-Rex: Tactile-Reactive Dexterous Manipulation》。指出过去具身行业在灵巧手触觉的探索方向可能错误,目前加触觉会让机器人变笨,但也给出解决方法,真机实测T-Rex表现优异。
登上Nature子刊!Meta脑机接口重大阶段性进展,超高实时解码准确率
Meta在非侵入式脑机接口研究取得重大进展,Brain2Qwerty v2能从原始脑信号实时解码句子,平均词准确率达61%,最优78%。研究团队开源训练代码,数据集也同步开放,但应用于临床仍面临精度和设备限制。
OpenAI曝出第一颗芯片叫「辣椒」!AI自己设计,9个月流片
OpenAI首颗自研芯片Jalapeño问世,9个月从白纸到流片,创行业最快纪录。该芯片专为大模型推理设计,由其AI参与设计优化,有望降低推理成本,提升用户体验。OpenAI欲做全栈AI公司。
伏曦量子完成天使及天使+轮融资,五源资本、启盈同创等跟投
近日,伏曦量子宣布完成天使及天使+轮融资,由全球动力电池行业龙头领投,多家机构跟投。该公司由赵琦博士创立,定位是帮助产业客户理解和使用量子算力,其核心价值是优化算法,让问题可在近期硬件测试。
马斯克麾下最惨打工人:手滑删掉xAI三周训练数据
xAI一名员工在数据迁移时误删了2到3周的核心训练数据,这或为Grok重组震荡后遗症。xAI为追Claude等,采取喂Cursor数据、自研V9等策略,还曾借道访问竞品模型。如今xAI把算力租给对手变现。
不只是DeepSeek V4,还有个万亿级大模型,训推全程国产芯片
2026年4月24日,DeepSeek发布新一代模型DeepSeek - V4系列预览版并开源。同日,美团用全国产算力集群训练出万亿参数大模型LongCat - 2.0系列预览版,训推全流程摆脱英伟达,在国产算力支撑万亿级模型研发上取得突破。
读完这篇,你就搞懂 DeepSeek v4 了
2026年4月24日,DeepSeek全新系列模型DeepSeek - V4预览版上线并开源,评分接近‘闭源三巨头’。该模型强在1.6T参数+1M上下文,还有从attention到kernel的系统级重构与优化,在架构和工程层面均有创新。
任务自适应 Harness:从 Trace 到多 Coding Agent 的协作记忆
作者为AI Coding准备的端到端方案未落地,后在Routa项目找到新落点。基于ACP协议的Agent Trace可记录关键行为,用于分析优化。还介绍了Feature Explorer、Kanban Harness及任务自适应Harness,探讨多Agent协作记忆。
马斯克暴走官宣:Grok 5就是AGI!五月连轰两代万亿怪兽,OpenAI慌了
马斯克宣称Grok 5就是AGI,5月将连发1T和1.5T两代万亿参数模型。Grok 4.3已上线,4.4、4.5将相继推出,Grok 5正以6万亿参数规模训练。不过,参数能否堆出AGI存争议。