「Agent 2.0」共找到 4702 篇相关文章
RLinf上新πRL:在线强化学习微调π0和π0.5
近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。
最新最完整的Agent Memory综述!
《Memory in the Age of AI Agents: A Survey》由多顶尖机构联合发布,对AI智能体记忆机制系统梳理。从形式、功能、动态维度厘清AI记忆本质,提出构建下一代强人工智能的蓝图。
小米MiMo Agent 跨会话进化
多数AI编程Agent任务一长就忘事,业界主流靠堆上下文窗口应对,但有缺陷。小米MiMo团队开源的MiMo Code,靠显式存储 - 检索机制,200步以上任务胜率超Claude Code达65%,介绍了其设计及优缺点。
1B参数,0.21秒识别,0.3%错字率:混元OCR拿下7项SOTA
腾讯开源模型 HunyuanOCR 在权威榜单 OmniDocBench 上霸榜,虽仅 1B 参数,却在 7 项任务击败众多大模型。它解决传统 OCR 流水线及通用大模型痛点,通过独特架构和训练方法实现高效准确识别。
5.8k Star 基于LangGraph的Multi-Agents炒股框架,7种Agent形成金融交易闭环
TradingAgents是模拟真实交易公司运作的多智能体交易框架,用LangGraph构建,有灵活性与模块化特点。由7种LLM驱动的专业智能体协同评估市场、制定决策,还介绍了架构和实战操作。
2.2K标星!一个库打包37个翻译平台,开发者再也不用为翻译API头疼了!
在项目开发中,翻译需求常让开发者为适配各平台 API 头疼。近期 GitHub 上的开源 Python 库 Translators 是省心之选,它集成 37 个主流翻译平台,统一接口,免 API 密钥,支持 450+ 语言互译。
AI 基础知识从 0.6 到 0.7—— 彻底拆解深度神经网络训练的五大核心步骤
文章以 PyTorch 手写数字识别代码为引,深入剖析深度神经网络训练的五大核心步骤,涵盖前向传播、计算损失、反向传播、更新参数和循环训练,还介绍激活函数、Dropout 等概念及正则化、优化器等技术。
阿里最新开源王炸Agent!性能全面SOTA!
阿里WebAgent更新频繁,基本一月一版。它是类似DeepResearch的通用智能体,历经WebWalker到WebWatcher多阶段演进,各阶段解决不同问题,如网页导航、自主信息搜集等,还不断优化训练数据生成与处理方式。
东方理工团队提出HiDrop:重构MLLM计算路径,压缩90%视觉Token实现2.2倍加速
东方理工大学沈晓宇团队提出HiDrop,基于MLLM不同层功能差异,设计出延迟注入、凹金字塔式剪枝和提前退出的视觉Token压缩策略。实验显示,它能压缩约90%视觉Token,保持98.3%性能,实现训练和预填充加速。
刚刚,这家0产品0模型就估值854亿的公司,终于发布了首款产品!
Thinking Machines Lab推出首款产品「Tinker」,这是专为语言模型微调而生的API,让开发者摆脱底层架构束缚,用简单Python代码专注创新。它功能强大,目前免费私测,已获普林斯顿、斯坦福等团队使用。