「半在线强化学习」共找到 1577 篇相关文章
年前看到最有深度的AI下半场Agents记忆机制综述
本文是一篇83页的基础智能体记忆机制综述,由27家机构联合发表。提出AI研究范式转变,记忆是填补理想与现实差距的关键。构建三维统一分类框架,介绍记忆操作、学习策略、评估体系、应用场景及未来方向。
登上Science Robotics顶刊!清华团队耗时22年,终于教会机器人踢足球
今年8月,清华赵明国教授团队联合字节跳动Seed等在《Science Robotics》发表论文,提出视觉驱动的反应式足球技能学习框架。该研究历经22年技术接力,成果在真机和赛事中验证,加速进化平台助力研究。
Ilya的第一个模型,被曝本月上线
新智元报道,投资人Gavin Baker称Ilya Sutskever创立的SSI本月将发布首个模型。他还提及持续学习等技术或影响英伟达显卡需求,且指出Claude成华尔街“克朗凯特”,带来市场共识同质化。
GPT-6要「活」了?MIT新作曝光,AI「自进化」不远了
麻省理工学院推出全新自适应大模型框架「SEAL」,让模型从「被动学习者」变为「主动进化者」。网友猜测GPT - 6可能整合其能力,成为能自主学习的模型,研究虽有局限,但为大模型自进化提供新路径。
卡帕西预言成真!华人团队开源全AI操作系统:神经网络模拟Windows,预测下一帧屏幕图像
大神卡帕西曾预言“AI时代的图形用户界面”,受此启发,华人团队提出NeuralOS,靠RNN和渲染器模拟Windows,能预测下一帧屏幕图像。虽对键盘精细操作处理欠佳,但已开源,有在线体验版。
OpenAI o1核心大佬离职后首次演讲!AI智能体=人力+代码「无限杠杆」
OpenAI研究员Hyung Won Chung离职后发声,认为AI是人类历史上最强大杠杆,结合人力与科技优势。它能提升个人学习效率,智能体作为复合杠杆让小团队创造大价值,还能加速社会科学进步。
4月30日凌晨,Meta举行首届AI开发者大会LlamaCon,推出Meta AI聊天机器人应用程序与ChatGPT竞争,发布Llama API。Meta试图强化开源模型生态系统以限制OpenAI发展,扎克伯格与微软CEO还探讨了开源闭源模型生态等内容。
Ilya新模型要来了?投资人爆料:今年最重要的发布!
a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的新模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。
腾讯混元CL-bench续作发布,让大模型读懂你的日常生活
腾讯混元团队推出CL - Bench Life,用于精准衡量AI在现实生活中的“上下文学习”能力。测试12个语言模型,结果显示模型处理高噪声零碎context能力不足,揭示当前顶尖AI模型还远未读懂日常。
零基础指南:从 Prompt 到上下文工程构建 AI Agent 【万字长】
作者结合培训经历,系统梳理零基础构建 AI Agent 的学习路径,涵盖结构化提示词工程、上下文工程与知识检索、工具函数设计和 Agent 规划等内容,还介绍各环节方法、策略和实践案例。