「多任务学习」共找到 6165 篇相关文章
让AI打游戏!能玩1000多款游戏,英伟达用4万小时视频训练出通用基础模型NitroGen
NVIDIA发布NitroGen模型,利用40000小时带按键显示的游戏视频,构建视觉-动作数据集,训练出能玩超1000款游戏的通用基础模型,在跨游戏泛化和微调任务中表现卓越,为具身智能发展提供新思路。
Codex 积分制计费上线,Claude Code 急了……
OpenAI Developers宣布Codex推出积分制度,重置速率限制,ChatGPT Plus和Pro用户可买积分获额外使用量,每1000积分40美元。云端任务将计入速率限制,社区反应不一,且积分会过期,Claude Code为挽回用户送会员。
为何底层数据湖决定了 AI Agent 的上限?
随着 AI 落地企业进程加快,数据类型更丰富,传统企业级数据架构面临瓶颈。火山引擎构建多模态数据湖,以 Lance 为湖格式,从多维度选型技术,解决存储等问题,在多行业有应用潜力。
破解「长程智能体」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o
腾讯混元AI数字人团队提出RLVMR框架,将‘元认知’理论引入RL,通过奖励‘好的思考过程’解决长程任务中智能体的低效探索与泛化难题,经其训练的7B模型表现出色。
Grok 4刷新ARC-AGI-2纪录:15.9%碾压所有公开模型,我们离AGI还有多远?
xAI的Grok 4在ARC-AGI-2测试中获15.9%,成全球最强公开AI模型。ARC Prize主席还原测试过程,虽成绩亮眼,但网友有质疑,且离人类表现差距大。Grok 4在多基准测试领先,定价便宜。
构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理
企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。
GPT-5核心推手闪电跳槽,Anthropic CEO高调炫耀员工留存碾压OpenAI,“AI第一公司”光环崩塌?
OpenAI后训练负责人、GPT - 5核心推手Max Schwarzer跳槽至Anthropic,此前也有多位技术领袖离开。OpenAI在商业版图扩张与伦理争议并存下,正从参数军备赛转向体验护城河,同时加速商业与政治布局,但面临人才流失等问题。
美团开源全模态,比肩顶级闭源模型,开源新SOTA
美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。
刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想
本周五,谷歌向 Google AI Ultra 订阅用户推出 Deep Think 功能,提供全版本 Gemini 2.5 Deep Think 模型给部分数学家。该模型是获 IMO 金牌模型变体,速度更快,有并行思维等技术,在多领域有用且测试成绩优。
Google开源MCP数据库工具箱轻松连接各类数据库
近日Google开源新项目genai - toolbox,它是为数据库设计的MCP服务器,能让开发者用不到10行代码将数据库工具集成到AI应用。该项目封装复杂问题,有动态工具注册机制,支持主流数据库,提供多语言SDK和多种部署方式。