「多任务强化学习」共找到 3188 篇相关文章
智源:ArXiv CLI重磅开源!2亿+开放论文,即将化身科研智能体的技能包
智源研究院联合高校与社区开发者研发的 DeepXiv 开源并免费开放。它是面向智能体的科技文献综合性工具集,提供数据接入、一站式能力集成、丰富接入形式等核心能力,还通过实战演示展示其在科研任务中的价值。
比豆包手机还狠!Gemini电视登场CES,谷歌打响客厅革命第一枪
2026年CES上科技新品频出,谷歌将Gemini AI引入Google TV,让电视具备自然语言内容发现与推荐、教育深度学习等功能,还增强语音控制能力,打响客厅AI革命第一枪,同时涂鸦智能展示了AI生活助手等产品。
上班后重新开始练口语,并获得了价值感
作者分享上班后用AI练口语的经历,称能无痛坚持,还获得价值感。介绍了AI练口语比线上外教课的优势,如免费、时间灵活等,也分享利用AI练口语的方法,如选话题、当场学习等。
马斯克Grok 4.6重回一梯队!更低价格反超Fable 5,这Cursor是真没白收购
马斯克携Grok 4.6让SpaceXAI重回大模型牌桌。它跑分超GPT - 5.6 Sol和Fable 5 Max,价格更低。此次升级聚焦长程agent任务,还发布了Grok Bot智能体,后续Grok 4.7也将登场。
给Agent装上“海马体”!上海AILab开源MemVerse,定义多模态记忆新范式
上海人工智能实验室开源MemVerse,这是首个面向智能体的通用多模态记忆框架。它将多模态信息与文本对齐到统一语义空间,首创‘双通路’架构与‘记忆蒸馏’技术,让智能体有终身记忆能力,在多模态任务中表现出色。
李飞飞一年前究竟说了啥?怎么又火了
AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。
GPT-5通关《宝可梦水晶》创纪录!9517步击败赤爷,效率碾压o3三倍!
GPT-5通关《宝可梦水晶》创纪录,仅9517步击败赤爷,步数为o3的三分之一。它在主线任务效率也远超o3,如收集徽章、对战四天王等。其优势在于幻觉少、空间推理和目标规划能力强。
DeepMind掌门自曝AGI倒计时5年!算力需求暴增10倍,推理计算吞噬一切
在最新播客中,DeepMind掌门Hassabis表示自然界规律能被机器学习算法模仿。他畅想AGI应用于游戏,还提及迈向AGI要扩大计算规模,算力需求或增10倍,且运营上以初创公司模式兼顾研究与产品。
LLM提示三剑客:解密CoT、ReAct、DSP如何提升AI准确率?
LLM提示分思维链(CoT)、ReAct和声明式自我提示(DSP)三类。CoT鼓励模型推理,适合多步骤复杂问题;ReAct结合推理与动作,是代理基础;DSP让模型声明计划,用于模块化任务。还给出使用场景与对比。
英伟达All in的物理AI路线,居然是中国黑马提前一年就定义好了
全球具身智能行业为技术路线争论时,中国深度机智率先提出并跑通「人类学习」路线,以人类数据为起点、动作建模为中心、机器人为AI而生,英伟达等跟进,深度机智全栈落地且进度领先。