两阶段训练法」共找到 3112 篇相关文章

新闻资讯8

AMI Labs 冯雁:AI 迈向现实世界,世界模型不可或缺 | ICML 2026

2026年7月7日,AMI Labs冯雁在ICML 2026带来特邀演讲,系统回答三个核心命题。她认为AI迈向现实世界,世界模型不可或缺,JEPA世界模型比生成式更具结构性优势,团队也取得系列关键突破。

AI科技评论
新闻资讯7

刚刚,Fable 5全球解禁!

美国商务部撤销对Anthropic旗下Fable 5、Mythos 5出口管制,禁令由商务部长Lutnick签字解除。Anthropic官宣明天恢复访问,这款模型无需许可、审批即可全球使用,此前封禁让开发者陷入“戒断期”。

新智元
推荐文章8

AI产业的新胜负手:词元的生产与编排|甲子光年智库

AI产业正走向“代理式执行”,核心生产逻辑从“数据驱动”转为“词元驱动”。文章阐述了词元经济的形成、生产过程及运行链路,指出AI竞争将围绕词元生产与编排展开。

甲子光年
8

刚刚,国产Agent模型闯入全球第一梯队!限时免费

昆仑万维发布SkyClaw-v1.0及其轻量版SkyClaw-v1.0-lite Agent模型,性能达全球第一梯队,价格仅主流顶尖模型一半甚至更低,适配主流Agent框架,还兼容OpenAI接口,现限时免费,后续将逐步开源。

量子位
新闻资讯7

马斯克诉OpenAI案终落幕:1500亿索赔因“告晚了”被驳回

2026年5月18日,“马斯克起诉OpenAI”案裁决,OpenAI无需担责,马斯克诉求被驳回,原因是诉讼时效已过。这场官司拉扯年多,索赔从数十亿增至1340亿美元。庭审暴露双方问题,后续资本战将开启。

DeepTech深科技
算法论文8

让大模型学会「自己教自己」!京东&中科院信工所连发三篇论文定义Self-Taught RLVR

京东和中科院信工所开展Self - Taught RLVR系列研究,连发三篇论文。从RLSD、NPO、CoPD三个维度探索让大模型自我指导。如RLSD解决信息泄漏,NPO引入有效学习信号,CoPD整合多专家能力,各有创新与良好效果。

量子位
推荐文章7

理解

作者以研究‘理解’概念为切入点,借助侯世达思想提出理解是脑海中‘云’的形状,其形成有横向相似度与纵向抽象度个方向,并结合费曼说法等阐述‘云’视角下的理解。

李继刚
开源动态8

让大模型理解真实医疗视频,全球首个开源技术方案来了!

AI 进入医疗领域需谨慎,此前美国引入不成熟 AI 致手术失误频发。全球首个医疗视频理解大模型元智医疗视频理解大模型发布并开源,解决了医疗视频领域的任务优化、数据缺失和无法评测痛点。

机器之心
新闻资讯8

全球自动驾驶激战,滴滴与清华走出一条技术新路

2026年全球自动驾驶竞赛白热化,Waymo高歌猛进,特斯拉遇困境。滴滴与清华合作,成立实验室,发布STAPO算法,打通产学研链路。滴滴自动驾驶低调务实,掌握全栈技术,将出海阿联酋,其主业优势保障稳健发展。

新智元
开源动态8

探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜

南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技