自奖励训练」共找到 3112 篇相关文章

新闻资讯7

OpenAI重组GPT-5「灵魂」团队!亚裔女负责人遭调离,罕见曝AI幻觉祸首

OpenAI进行重磅结构调整,ChatGPT「模型行为」团队并入Post - Training,前负责人Joanne Jang负责新OAI Labs。同时,OpenAI揭秘AI产生「幻觉」的罪魁祸首是「应试」评估体系。

新智元
新闻资讯7

曝曾想拆分英伟达,特朗普签署最激进「AI行动计划」,全行业去监管

当地时间本周三,特朗普签署三项行政命令、概述「人工智能行动计划」,含超90项政策行动,计划明年实施。该计划旨在消除监管、加快AI发展,还谈及拆分英伟达、放宽芯片出口等事。

机器之心
开源动态8

500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

香港城市大学等团队发布图像 - 视频生成模型Pusa V1.0,在基础大模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力。

量子位
新闻资讯7

GPT-5七月上线?内部爆料+奥特曼疯狂暗示,曝前方时刻「令人恐惧」

近日,多方消息显示OpenAI可能7月发布GPT - 5,奥特曼也确认o3 pro快来了。人们对GPT - 5期待颇高,猜测其能力有提升也有局限。奥特曼访谈透露AI会带来多方面变化,应服务个人意志。

新智元
新闻资讯7

四大AI手搓蒙娜丽莎!8次临摹,最像那版全被己改没了

AI工具平台TryAI搭建「绘画竞技场」,让GPT - 5.6 Sol等四个视觉模型临摹蒙娜丽莎等,记录实验过程。结果显示,模型最终作品不如中途最佳版,且成本差异大,工具使用方式不同。

新智元
产品应用7

谷歌把电脑操作能力塞进Gemini 3.5 Flash!己看屏幕狂点70轮

谷歌将电脑操作能力Computer Use内置进Gemini 3.5 Flash,该AI能通过看屏幕操作电脑,可执行点击、打字等动作。其覆盖网页、桌面软件和移动端,还加入安全约束机制,在基准测试中表现良好。

量子位
算法论文8

挑战扩散回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改

五一期间字节商业化技术团队研发出新一代视觉生成模型,其底层架构是全新的第三条路——生成精炼网络GRN。它能让AI像人一样边画边改,解决了现有模型的问题,在多项基准测试中刷新SOTA记录。

量子位
新闻资讯8

给AI发100美元去二手市场捡漏,结果它给己买了19个乒乓球

2025 - 2026年,Anthropic进行“Project Deal”实验,让69个Claude智能体在真实双边市场主交易,完成186笔超4000美元交易。实验发现模型能力影响交易结果,还揭示了AI代理交易存在的问题和隐忧。

DeepTech深科技
算法论文8

肝脏也能“按需定制”?科学家研发新型植入物,让肝组织在体内己长

哈佛大学怀斯研究所团队研发“BOOST”策略,结合组织工程与合成生物学,创造可在体内远程接收成长指令的工程化肝脏构建体,在动物实验中实现植入后按需扩增,为解决肝脏移植供体短缺带来新希望。

DeepTech深科技
新闻资讯8

深度机智和他们的另一条路:用人类第一视角数据训练基座模型|甲子光年

3月27日,深度机智联合推出具身通用智能基座模型系统PhysBrain 1.0,引入人类第一视角数据,解决传统模型问题。其创始人陈凯等坚持用此数据构建模型,突破传统,引领行业新方向,且中国在具身智能领域或借此建立主技术体系。

甲子光年