策略内自蒸馏」共找到 1357 篇相关文章

新闻资讯8

中国 AI 投资人:练习时长两年半

文章是对多家投资机构的访谈,探讨AI投资与创业趋势。涉及Manus成功经验、DeepSeek影响、模型公司前景、应用机会等,还谈及创业者应对策略、投资策略变化及行业未来思考。

Founder Park
算法论文8

如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程

丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。

机器之心
产品应用8

jina-reranker-v3刷新全球重排榜,效率狂飙4.79%

jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率与效果权衡、多语言文档重排性能与效率平衡、模型泛化能力和适应性等问题,架构与训练方案有创新。

CourseAI
算法论文7

苹果港大终结自回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!

苹果联合港大开源扩散大语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。研究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。

新智元
算法论文8

让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品

斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。

量子位
算法论文8

模拟大脑功能分化!北大与港中文发布Fast-in-Slow VLA,让“快行动”和“慢推理”统一协作

北大与港中文研究团队发布 Fast-in-Slow(FiS-VLA)全新双系统视觉 - 语言 - 动作模型,将快速执行模块嵌入预训练视觉 - 语言模型,实现快慢系统一体化。该模型在多平台表现优异,控制频率大幅领先。

机器之心
推荐文章7

多邻国的「AI-first」到底是什么?|AGIX投什么

本文深度访谈多邻国联合创始人及CTO Severin Hacker,探讨其“AI-first”策略。多邻国自成立就确立该理念,AI提升容创作效率、实现新功能,在运营多方面应用,还分享早期教训、产品策略和团队文化等。

海外独角兽
新闻资讯7

硅谷甄嬛传爆更,马斯克转发!Ilya动手那一夜,谁捅了奥特曼一刀?

硅谷版《甄嬛传》精彩上演,理想主义者Ilya对决野心家奥特曼,马斯克火上浇油。Ilya备忘录指控奥特曼撒谎等,揭示OpenAI部斗争。Ilya与Mira密谋除奥特曼,还错判员工反应,董事曾要求Ilya起草备忘录。

新智元
算法论文7

JCP | 浙江大学边鑫等:基于 PINNs 的非结构自适应网格细化:面向稳态流动的残差驱动 AMR 新方法

本文提出利用控制方程残差引导网格细化的启发式策略,用物理信息神经网络(PINNs)整合粗网格数据与控制方程。通过解决流动问题并与传统方法对比,显示该策略能平衡计算精度与成本,但有额外计算开销。

力学与人工智能
新闻资讯7

刚刚,Claude两个新模型曝光!

开发者在Anthropic的API中发现Claude的两个新模型代号claude - marshmallow - eap和claude - melon - eap,目前处于部测试阶段。社区有多种推测,且Anthropic命名风格改变,新模型或下月发布。

机器之心