「强化学习范式」共找到 2266 篇相关文章
AI Agent的上下文工程:构建Manus的经验教训
上下文工程是AI智能体的“系统一”,决定其速度、恢复力与扩展边界。Manus通过试错与用户验证,给出可复用经验,如利用大模型“上下文学习”能力、关注KV - cache命中率等。
西湖大学科研版NanoBanana开源!科研绘图从此自动化
西湖大学将科研版NanoBanana开源,其AutoFigure框架可自动化生成学术插图且能编辑,论文被ICLR 2026接收。该框架提出理性渲染范式,配套FigureBench基准测试集,表现超越人类预期。
我去,短短时间,狂揽27.4K星,Windows用户的春天,任务栏秒开Linux的「神器」来了,6的飞起
由 Cascadium 团队打造的 WSL Windows Toolbar Launcher,将 Linux 终端装进 Windows 任务栏。它有一触即发控制台、状态感知任务栏等功能,适用全栈开发、机器学习等场景,与同类项目相比优势明显。
Agent不是关键!人大AiScientist实现23小时、74轮长程记忆
中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。
包含一个 75+ AI 工程项目!所有内容100%开源
此 GitHub 仓库含 93+ 生产级 AI 项目,覆盖大语言模型、RAG、Agent 等主题。有不同难度项目及教程,适合各水平人士,还给出新手入门学习路径,采用 MIT 许可。
国务院关于深入实施“人工智能+”行动的意见
国务院发布意见深入实施“人工智能+”行动,推动其与各行业领域融合。提出到2027年、2030年和2035年的目标,部署重点行动,强化基础支撑能力,明确组织实施要求。
14.5K!冲上Github Trending榜,字节最新开源Agent上下文"数据库"!
OpenViking是字节跳动火山引擎开源的AI Agent上下文数据库。它用文件系统范式管理上下文,有分层加载、递归检索、可视化轨迹和自动会话管理等特性,支持多种模型,测试效果显著。
不用抗生素也能抗菌!AI设计新型蛋白质抵御细菌耐药性|Nature子刊
澳大利亚研究借助AI工具设计出能与ChuA结合的蛋白质,抑制大肠杆菌等细菌生长。这些蛋白质像“分子锁”,阻断细菌获取血红素,降低耐药风险,开创“非抗生素”抗菌新范式。
刚刚,Thinking Machines出手!首款交互模型来了,翁荔出镜实测
Thinking Machines Lab推出首个大模型TML - Interaction - Small,打破传统人机交互模式,实现全自然交互。它训练范式独特,采用双模型架构等设计,评测表现超GPT - Realtime 2.0等模型,后续还会推出更大尺寸模型。
让记忆学会“进化”:探索 LLM Agent 的运行时价值感知与自适应检索 | 直播预约
本次直播将介绍最新研究成果 MemRL,提出作用于情景记忆的运行时强化学习方法,使 LLM Agent 能判断记忆价值,检索高价值经验,提升复杂未知环境下泛化性能与任务成功率。