预训练数据」共找到 3967 篇相关文章

产品应用8

通向L3的正确范式?理想i8全球首发VLA高阶辅助驾驶,我们帮你试了试

本周二,理想全新纯电SUV理想i8上市,其搭载的VLA辅助驾驶系统受关注。理想发现端到端数据驱动升级有局限,VLA架构改进让系统有思维、沟通等能力,还带来平顺性等提升,且研发各方面能力强。

机器之心
推荐文章7

深度剖析将 Kafka 构建在 S3 上的技术挑战与最佳实践

文章基于AutoMQ深入剖析将Kafka构建在S3上的挑战与解法。探讨延迟、IOPS、缓存管理等问题,介绍AutoMQ应对策略,如用WAL+S3架构降低延迟、批处理数据减少请求等,还提及Kafka兼容性及跨区流量成本处理。

InfoQ
新闻资讯8

一篇被证明“理论有误”的论文,拿下了ICML2025时间检验奖

2015年发表的Batch Normalization论文在ICML 2025会议获时间检验奖。它引用超6万次,推动了深层神经网络发展。虽2018年被指理论有误,但仍有新研究发现其对训练过程的根本影响。

量子位
推荐文章7

AI 引领的企业级智能分析架构演进与行业实践

在 QCon 全球软件开发大会(北京站)上,数势科技 AI 负责人李飞分享了企业级智能分析架构演进与实践。探讨了智能分析落地问题,介绍 Agent 结合数据分析优势、技术路线及落地要点,还对 Agent 发展给出思考与展望。

InfoQ
算法论文8

沉迷贪吃蛇,7B小模型竟变身「数学天才」!几何推理碾压GPT-4o

NVIDIA等团队提出视觉游戏学习ViGaL范式,让7B多模态模型玩贪吃蛇等游戏,使其在数学、几何等任务击败GPT - 4o。游戏培养通用认知与推理能力,不同游戏提升不同推理能力,多游戏训练效果更佳。

新智元
算法论文7

ICCV2025 | 多视图生成新范式-利用自回归模型探索多视图生成

本文介绍自回归生成多视图图像方法 MVAR,能从先前视图提取引导信息增强一致性,拉近与基于扩散方法的图像质量差距。解决了多模态条件控制和数据有限问题,展示出强指令遵从与多视角一致性。

机器之心
算法论文8

物理AI的「原生」时刻:原力灵机发布具身大模型DM0

主流‘训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出具身原生 VLA 模型 DM0。它能统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。

机器之心
产品应用8

DeepSeek-R1全升级V2版:Token成本低至原来30%

DeepSeek - R1 V2版全维度升级,训练框架从‘单一RL’到‘多阶段协同优化’,推理能力从‘能推理’到‘会优化推理’,还提升了安全可控性,适配生态,推出轻量级模型。

CourseAI
算法论文8

大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。

量子位
新闻资讯7

28岁Alexandr Wang,没走!小扎晒出合照

近日网传华裔天才Alexandr Wang被架空或离职,小扎晒合影辟谣。同时,小扎官宣成立「AI工程部门」,与MSL合作打造数据引擎。Meta开发的牛油果模型被指能力强,若效率数据属实,或为Meta带来利好。

新智元