自奖励训练」共找到 3130 篇相关文章

新闻资讯8

两个16岁的高中生,共享了己的显卡和API,想让全校同学都免费用上AI。

本文讲述了两位16岁高中生张睿修和冯子上的故事。他们成立炼丹社,将己的显卡、服务器等资源共享,搭建FreeAPI项目,让全校同学免费用AI。两人性格不同但都爱创造,还在帮学校做校园网站。

数字生命卡兹克
开源动态8

Nanbeige4.2-3B:探索通用Agent小模型

在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。

AIGC开放社区
新闻资讯8

梁文锋叫停签约,DeepSeek百亿新融资或全面暂停;白宫控月之暗面蒸馏Anthropic Fable 5遭驳;腾讯员工晒317万年终奖被辞永不录用|Q资讯

本文汇总一周AI行业热点,有DeepSeek百亿融资或暂停、Karpathy或从Anthropic离职等消息,还涉及腾讯、360、美团等公司动态,以及多个新模型发布与技术成果。

InfoQ
算法论文8

怎么量化机器人数据价值?ATHENA将影响函数扩展到十亿参数VLA,313×加速筛选高价值数据

具身智能进入数据scaling时代,VLA模型训练中数据并非越多越好。上海交大同济等校团队提出ATHENA框架,将影响函数扩展到十亿参数VLA模型,解决计算和筛选难题,实现313倍加速,实验证明其用更少数据获更好效果。

机器之心
算法论文8

李飞飞 、 英伟达 Jim Fan 、徐丹飞三巨头联合重磅论文,改写灵巧手触觉赛道

近日,李飞飞、英伟达Jim Fan等顶尖学者联合发表论文《T-Rex: Tactile-Reactive Dexterous Manipulation》。指出过去具身行业在灵巧手触觉的探索方向可能错误,目前加触觉会让机器人变笨,但也给出解决方法,真机实测T-Rex表现优异。

AI科技评论
开源动态8

登上Nature子刊!Meta脑机接口重大阶段性进展,超高实时解码准确率

Meta在非侵入式脑机接口研究取得重大进展,Brain2Qwerty v2能从原始脑信号实时解码句子,平均词准确率达61%,最优78%。研究团队开源训练代码,数据集也同步开放,但应用于临床仍面临精度和设备限制。

机器之心
开源动态7

离谱!我以为它只是提示词合集,结果 16.4 万 Star prompts.chat 直接把 Prompt 收藏夹干成团队资产库

一开始以为 prompts.chat 只是提示词合集,实际它把零散 Prompt 变成可搜索、可托管、可接工具链的团队资产库。截至 2026-06-29,它在 GitHub 有 16.4 万 Star,还介绍了其功能、适用场景和局限。

小华同学ai
新闻资讯7

OpenAI博通联手发芯片,黄仁勋还能保持松弛吗?

OpenAI与博通联手发布研推理芯片Jalapeño,英伟达虽业绩亮眼但正被围攻。博通的ASIC芯片及通信优势、中立身份受青睐,OpenAI和Anthropic也正脱离英伟达管控,博通靠“芯片主权外包”模式上位。

芯师爷
新闻资讯7

机器人整机是“有限游戏”?对话星海图创始人:具身智能商业化的三个阶段,终点是卖Token

星海图CEO高继扬等提出具身智能三重跃迁,发布新模型并开源,首秀研机器人。公司从整机起步,联合建数据公司,规划数据量。其商业模式分三阶段,认为中国具身基础模型能力有望超美。

AI前线
新闻资讯8

不只是DeepSeek V4,还有个万亿级大模型,训推全程国产芯片

2026年4月24日,DeepSeek发布新一代模型DeepSeek - V4系列预览版并开源。同日,美团用全国产算力集群训练出万亿参数大模型LongCat - 2.0系列预览版,训推全流程摆脱英伟达,在国产算力支撑万亿级模型研发上取得突破。

机器之心