「有监督学习」共找到 7102 篇相关文章
中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026
中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。
HeyGen开源HyperFrames框架:Remotion劲敌,用HTML写视频的时代来了
HeyGen开源HyperFrames框架,解决视频制作专业工具学习成本高、简单工具缺灵活性的矛盾。它基于HTML,与Remotion设计哲学不同,渲染快、输出体积轻,有诸多特性和应用场景,安装简单。
这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude
Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是全新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。
中学生就能看懂:从零开始理解LLM内部原理【十二】|位置嵌入 - 给模型装上"GPS"
文章指出Transformer对词顺序不敏感,引出位置嵌入概念。介绍经典的函数编码、可学习位置嵌入法及新主流RoPE,还提及为让模型处理长文本,在RoPE基础上用PI和YaRN等扩窗技巧。
Anthropic发布重大更新推出CC进化版Claude Tag,Karpathy:LLM第三次交互革命来了
Anthropic推出Claude Tag,是Claude Code进化版,更主动适合团队协作。有多人协作、持续学习等四大优势,权限分频道隔离。Claude Enterprise和Team用户可在beta阶段用,Andrej Karpathy称是LLM第三次交互革命。
网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 大模型推理加速架构
网易游戏打造 Tmax AI 机器学习平台,但大模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。
机器人GPT时刻!英伟达WAM赋予全机器人零样本操作能力
英伟达发布世界动作模型 DreamZero,通过耦合视频生成与动作预测,让机器人有物理直觉,能在陌生环境完成复杂任务。它用异构数据学习,适配不同机体,还经优化实现高速推理。
拥抱大模型:深入剖析ReAct的核心原理、技术架构及其对AI领域的深远影响
文章深入剖析ReAct,它是普林斯顿大学和谷歌团队提出的智能体架构范式,将推理与行动协同,构建TAO闭环。介绍其原理、架构,指出解决传统AI难题,也存在局限,未来可与强化学习等融合。
把AI装进数据库:PostgresML和Korvus的新思路
当下机器学习应用开发流程复杂,开源数据库Postgres带来惊喜。PostgresML团队让AI模型跑在数据库中,介绍了PostgresML和Korvus两个关键项目,二者结合降低复杂度,让‘在SQL里跑AI’成工程现实。
ICML 2025放榜!接收率26.9%,高分被拒,低分录用惹争议
第42届国际机器学习大会(ICML)2025放榜,接收率26.9%。文章汇总了被接收的优秀论文如MARS、ShadowKV等,以及有争议的论文,一些高分被拒、低分录用,评审存在矛盾与粗心问题,欢迎读者在评论区讨论。