两阶段监督微调」共找到 1090 篇相关文章

新闻资讯8

00后以1.1亿美金「掀桌」,硅谷AI将书写影视新传奇 终结制片旧时代

00后Cecilia Shen创立的Cybever转型为AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术经四个阶段进步,能生成高质量3D虚拟环境,还带来两部大剧,有望改变影视行业格局。

机器之心
新闻资讯8

人工智能提出七十载!从百度CTO到NVIDIA副总裁,十年共启ASI新智元

今年是人工智能提出七十周年,新智元十周年峰会9月7日将在北京举行,届时发布《2025新智元ASI前沿趋势报告》。峰会集结百度CTO、NVIDIA副总裁等十位领航者,以‘十人十题’解构AI五阶段路线图,纵览AI发展图景。

新智元
新闻资讯8

训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法

将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。

AIGC开放社区
新闻资讯7

谷歌推出 Jules:一款基于 Gemini 2.5 的异步编程智能体

谷歌将异步智能编程助手 Jules 正式发布,它基于 Gemini 2.5 Pro 模型,可执行多种编程活动。采用异步模式,直接接入代码库。测试阶段开发者反馈多,正式版有三种访问层级,但部分用户对其界面和输出质量不满。

InfoQ
开源动态8

智谱终于发布GLM-4.5技术报告,从预训练到后训练,细节大公开

上个月底智谱开源 GLM-4.5 及轻量版,成绩亮眼引热议。现其技术报告发布,详述预训练到后训练细节,还介绍了开源 RL 框架 slime,展示模型架构、训练阶段等,评估了在多任务上的表现。

机器之心
新闻资讯8

@所有开发者:Agent变现,阿里云百炼联合支付宝首创「AI打赏」!Agent Store全新发布

2025年是Agent元年,不过很多项目卡在POC阶段。6月25日阿里云百炼3.0全新升级,联合支付宝推“Agent打赏”功能,还上线Agent Store。此外,它升级多模态RAG和MCP能力,推出多模态交互开发套件。

量子位
新闻资讯7

骂战半年、站队失效,具身智能公司集体换了“新剧本”,VLA“自救”成功了吗?

2026年具身智能赛道经历‘技术路线大分流’,VLA遭质疑,‘世界模型’和VA路线兴起。具身智能进入‘落地祛魅’阶段,厂商开始‘路线混搭’,VLA和世界模型都在进化,行业探索新架构,具身智能无完整技术路线图。

InfoQ
开源动态8

机器人看29s视频学会一个新技能,自变量开源HOST框架

自变量机器人开源的HOST框架,让机器人看29s人类示范视频就能学会新技能,原技能不受影响。它通过自定位级联预测,解决了人和机器人动作节奏、身体结构不同的问题,效率远超主流微调方案,推动机器人进家庭。

PaperAgent
新闻资讯8

刚刚,DeepMind经典巨作再封神!ICML 2026大奖公布

ICML 2026大奖公布,杰出论文奖中两篇扩散模型论文获奖,立场论文奖指出AI安全工具被挪用问题。时间检验奖颁给DeepMind经典论文。获奖名单显示扩散模型研究热,AI安全需审视,AI研究进入深度清理阶段

新智元
产品应用7

全球首个完全AI编写的训练框架来了,速度反超英伟达:面壁要用 AI 把国产算力软件重写一遍

面壁智能发布全球首个全由AI编写的训练框架ForgeTrain,在华为昇腾系列上验证,速度超英伟达Megatron 10%。其构建分三阶段,目标是为不同需求“现场锻造”软件,还为国产算力软件生态赶超提供新思路。

AI前线