预训练数据精炼」共找到 3943 篇相关文章

推荐文章8

对谈 Macaron 创始人陈锴杰:RL + Memory 让 Agent 成为用户专属的“哆啦 A 梦”|Best Minds

本文访谈 Macaron 创始人陈锴杰,探讨 RL+Memory 让 Agent 发展及 Macaron 产品。他强调 RL 在 Agent 开发重要性,介绍 Macaron 定位、特点、训练方式,还谈及社区设想、RL 应用及产品发展方向等。

海外独角兽
推荐文章7

过时的 Python 版本会让公司损失数百万美元

JetBrains报告显示83%的Python开发者用旧版本,这不仅是技术债务问题,还会增加云账单成本。Python新版本有显著性能提升,升级能节省成本,容器化也未加速升级。

InfoQ
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因

随着大语言模型发展,多智能体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还能助力系统自我提升。

PaperAgent
产品应用8

字节Seed最新版原生智能体来了!一个模型搞定手机/电脑/浏览器自主操作

字节Seed发布最新版原生智能体UI - TARS - 2,采用All in one原生设计,表现优于Claude和OpenAI Agent等。它通过多轮强化学习,解决智能体操作图形界面的四大难题,在多测试中表现出色。

量子位
算法论文8

不愧是中国机器人,乒乓打得太6了

清华姚班本科生苏智团队在论文中提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验中击球和回球率高,还能连打106拍。

量子位
开源动态8

空间智能卡脖子难题被杭州攻克!难倒GPT-5后,六小龙企业出手了

杭州群核科技发布空间大模型,深耕室内场景,直指‘空间一致性’痛点。其开源子模型具真实感全息漫游、可交互等特点。当前空间模型处早期,群核提出‘三位一体’战略,还将开源促行业发展。

量子位
新闻资讯8

首创郎园聚焦AI视听|北京AIGC视听产业创新中心启动!

8月19日,北京AIGC视听产业创新中心启用。朝阳区发布“政策服务包”,首创郎园公布“六大服务平台”,联合推出数据交易平台。此外,还发布人才计划、揭牌产教融合实验室,启动测评季活动。

郎园Station
新闻资讯8

陶哲轩「断粮」后,25年首次绝望怒吼:美国科学命脉被砍断!

美籍华人数学天才陶哲轩称,25年科研生涯从未如此绝望。白宫切断其科研经费,UCLA等科研圣地也濒临断粮。美国科研体系半年内遭‘血洗’,诸多项目中断,未来堪忧。

新智元
开源动态8

Meta视觉基座DINOv3王者归来:自监督首次全面超越弱监督,商用开源

Meta推出并开源视觉基础模型DINOv3,采用自监督学习,首次全面超越弱监督,可生成高质量高分辨率视觉特征。它在多任务表现出色,参数和数据量提升,还构建模型家族,已在多领域产生实际影响。

机器之心
开源动态7

强化学习+MCP=王炸?开源框架教AI在MCP中玩转工具解决任务,实测效果超越GPT!

科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,在闭环反馈中摸索出最优调用策略,实测在2/3的benchmark上达或超SOTA性能。

量子位