连续思维机」共找到 534 篇相关文章

新闻资讯7

突发!Jason wei也被小扎挖走了

Jason wei是OpenAI研究科学家,是思维链、强化学习研究重要推动者,2023年2月加入OpenAI,此前在谷歌大脑工作。他和HYUNG Won Chung一同被小扎挖走,二人是o系列模型及测试时间计算重要推动者。

AI寒武纪
推荐文章8

Agent性能暴涨90%,刷榜GAIA可太容易了~

今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。

探索AGI
算法论文8

MeanFlow再下一城,北大提出器人学习新范式MP1,实现速度与成功率双SOTA

北大研究团队提出器人学习新范式MP1,将MeanFlow引入器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真和真测试中,实现速度与成功率双SOTA。

机器之心
开源动态8

不吹不黑,在Agent任务上,kimi 2.6确实让我忘了Claude。

Kimi K2.6发布并开源,代码和Agent能力提升。作者测试发现,它在部署Claude Code源码、网站生成、多智能体任务等方面表现出色,审美提升,思维活跃,还能复刻文档风格,开源释放了前沿编程能力。

探索AGI
算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
新闻资讯8

碾压小扎!22岁成亿万富翁,2025年AI造富速度刷新人类认知

2025年AI成超级造富,将50多位创始人送入亿万富翁俱乐部。从大模型到应用层,AI渗透生活。巨额融资不断,巨头砸钱建基建,人才争夺激烈,多模态初创公司也受青睐,职场AI使用比例上升。

新智元
产品应用7

Unsloth让大模型跑在手上!

Unsloth放出教程,可将其微调模型部署到Pixel 8和iPhone 15 Pro。用ExecuTorch技术优化,Qwen2 - 0.5B在旗舰上表现流畅。教程介绍量化感知训练控制精度损失,还给出iOS和Android部署步骤及注意事项。

AI工程化
推荐文章7

在软件工程中,对 AI 的过度依赖,会加速工程师的无能

资深软件工程师Doug Slater指出,在软件工程中对大语言模型(LLM)过度依赖会加速工程师无能。LLM无法取代人类批判性思维,它在输出、输入、开发速度和用户技能等方面存在风险,且无法掌握程序理论和抵抗程序熵。

宝玉AI
开源动态8

器人进入“边做边学”时代:星尘发布在线强化学习框架,让动态投掷成功率提升超141%

星尘智能基座模型团队公布在线强化学习框架SmoothRL,解决异步执行环境中具身模型在线微调难题。该框架让策略更新对应硬件实际执行,攻克延迟失准问题,在多项真测试中大幅提升任务成功率。

AI前线
算法论文8

单条演示即可抓取一切:北大团队突破通用抓取,适配所有灵巧手本体

在灵巧手通用抓取研究中,传统强化学习面临挑战。北大及BeingBeyond团队提出DemoGrasp框架,以一次成功抓取演示轨迹为起点,通过编辑轨迹适应不同物体与姿态,提升学习效率和真性能,实验效果出色。

量子位