「学习模式」共找到 2223 篇相关文章
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程
丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。
刚刚,Claude独立攻克图论猜想,仅用31步!算法祖师爷高德纳震惊发文
Claude Opus 4.6仅用31步独立攻克图论猜想,算法祖师爷高德纳震惊发文,认为需重新评估生成式AI在数学研究中的作用。这标志着AI在自动推理和解决创造性问题上达到新里程碑。
编程奇点逼近,程序员斩杀线就在眼前!软件版YouTube时刻在发生
新智元报道,软件开发正迎来「YouTube时刻」,AI工具如Cursor、Claude Code等让编程变简单。A16z投资人预言App创建速率或飙升10倍,软件边际成本趋近零,人人可成开发者,不过程序员也面临被AI替代风险。
打造高可靠 AI 助手:Skill 编排、Workflow 设计与 Spec Coding 的深度实践
文章拆解上下文工程五大实践模式,对比 Skill 与 Subagent 差异,介绍 Vibe Coding、Spec Coding。分析使用 Skill 做 AI Coding 的问题,提出 Workflow 概念及解决办法,还说明了工作流使用方法和适用场景。
OpenClaw 带来的「非线性狂飙」,代码正在成为新世界的基础设施
2026年初AI圈撕裂感十足,OpenClaw在GitHub获18.7万星标且还在涨,Claude Code等让开发者工作模式巨变,代码进化溢出,软件和代码质变,人类与代码关系倒置。
第二代AI预训练范式:预测下个物理状态
英伟达科学家 Jim Fan 发布《第二代预训练范式》,指出当前以 LLM 为代表的第一代范式应用于物理世界时「水土不服」,认为第二代范式是「预测下一个物理状态」,引发机器学习社区讨论。
拒绝计算“一视同仁”!Elastic Attention:让大模型学会“看人下菜碟”
现代大语言模型用全注意力机制计算复杂度高,现有混合注意力策略是静态的。为此提出Elastic Attention,引入轻量级Attention Router,具备动态路由等亮点,在主流模型测试中效果好。
AgentIF-OneDay 发布,评估全场景长时复杂任务
红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。
卢宗青团队新作:人类先验打底,统一动作对齐,通用机器人模型正在落地
机器人行业核心问题是让机器在真实世界稳定行动。卢宗青团队论文《Being - H0.5: Scaling Human - Centric Robot Learning for Cross - Embodiment Generalization》给出通用操控路线,系统性解决多形态平台部署问题。
Gemini 3预训练负责人警告:模型战已从算法转向工程化!合成数据成代际跃迁核心,谷歌碾压OpenAI、Meta的秘密武器曝光
2025年底大模型“年终决战”,Gemini 3强势突围。其预训练负责人Sebastian Borgeaud指出,谷歌转向“做系统”,AI进入“数据有限”阶段,合成数据等构成未来进化路径,还分享了预训练热点与挑战。