超级预测者」共找到 1131 篇相关文章

算法论文8

MSRA清北推出强化预训练!取代传统自监督,14B模型媲美32B

微软亚洲研究院联合清北提出全新预训练范式RPT,将强化学习融入预训练,把预训练语料库重构为推理问题集。实验显示RPT-14B表现出色,在多方面媲美甚至超越32B模型,未来RL或在LLM预训练掀起风暴。

量子位
新闻资讯7

硅谷顶级AI天才成「团宠」:布林请吃饭,奥特曼约打牌

天价薪酬、创始人亲自出马、派私人飞机接送,为抢夺顶尖AI人才,硅谷大厂猛下血本。OpenAI、谷歌等公司不惜重金,争夺「超级明星研究员」,AI人才稀缺也迫使一些公司采取创意招聘策略。

新智元
开源动态8

机器人进入“边做边学”时代:星尘发布在线强化学习框架,让动态投掷成功率提升超141%

星尘智能基座模型团队公布在线强化学习框架SmoothRL,解决异步执行环境中具身模型在线微调难题。该框架让策略更新对应硬件实际执行,攻克延迟失准问题,在多项真机测试中大幅提升任务成功率。

AI前线
新闻资讯8

AMI Labs 冯雁:AI 迈向现实世界,世界模型不可或缺 | ICML 2026

2026年7月7日,AMI Labs冯雁在ICML 2026带来特邀演讲,系统回答三个核心命题。她认为AI迈向现实世界,世界模型不可或缺,JEPA世界模型比生成式更具结构性优势,团队也取得系列关键突破。

AI科技评论
开源动态8

比 Playwright 更给力,这个新开源的项目6啊~

GitHub上的BrowserAct项目是面向AI Agent的浏览器自动化CLI,是为AI Agent设计的真实浏览器执行层。它有三层反检测突破体系、三种浏览器模式等功能,能解决Agent操作浏览器的诸多问题,适合多场景。

开源先锋
新闻资讯7

DeepMind华人研究员Lun Wang离职,「评估」成制约模型能力飞跃的瓶颈

谷歌DeepMind研究员Lun Wang离职后发文指出,当下评估体系难以应对新模型,制约模型能力飞跃。现有评估多针对当前模型,新能力出现时往往无法预测,需构建能自我进化的评估系统。

机器之心
产品应用7

别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析

agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发一试。

小华同学ai
新闻资讯8

DeepMind 创始人 Hassabis 语出惊人:百万 token 只是在贴胶带,AGI 在 2030 年

DeepMind创始人Hassabis在访谈中评估AGI进展,认为当前范式是最终架构一部分,但持续学习等问题待解决,预计2030年左右实现AGI,还探讨了Agent、蒸馏等多方面内容,并给创业建议。

MacTalk
新闻资讯7

马斯克破大防了:私信求和遭拒,怒喷奥特曼Brockman「全美最恶人」

马斯克与OpenAI两兄弟庭审进入第二周,马斯克曾发短信提议和解遭拒后破防威胁。短信虽未作庭审证据,但舆论偏向OpenAI,其胜诉率下降。Brockman出庭承认报酬是次要动机,双方各亮手牌,后续奥特曼等将出庭。

量子位
产品应用8

这个Coding Agent框架要火!Cursor、Claud太慢了

AI Agent赛道爆发,开发编码代理效率低。新出的jcode框架将Coding Agent功能整合,解决痛点,内存效率高、启动快、资源占用少,还能为开发省80%底层开发时间。这是赛道成熟信号。

CourseAI