「过平滑问题」共找到 3424 篇相关文章
突破多模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力
多模态奖励模型(MRMs)对提升多模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在多模态奖励模型benchmark上有显著提升。
刚刚,OpenAI任命新CEO!
OpenAI宣布39岁的Fidji Simo出任「应用CEO」,向奥特曼汇报。奥特曼仍为CEO,未来专注研究、算力与安全。Fidji经验丰富,曾在Facebook工作十年,还担任过Instacart CEO。
特斯拉为什么非要造Cybercab?|甲子光年
北京时间9月4日,特斯拉低调发布Cybercab,已进入奥斯汀Robotaxi运营体系。它专为Robotaxi打造,无方向盘与踏板。文章探讨特斯拉造它的原因,涉及成本、生产等,也指出业务面临财务和法规问题。
让代码接管世界演化,西湖大学发布Code视频世界模型
西湖大学研究团队提出 Code World Model,将‘世界如何演化’和‘世界如何被看见’拆成两个互补问题,由 Coding Agent 决定世界演化,代码执行规则,视频模型转化为视觉观察,有应用潜力。
刚刚,OpenAI GPT-6 Astra震撼发布!AGI时代来了
OpenAI正式发布GPT - 6 Astra,总裁称已到AGI时代。该模型定位为“世界上最智能、最对齐的模型”,在多领域表现出色,能力强、速度快、成本低,还具备“关键级”网络安全能力,将逐步开放给用户。
5个月估值翻10倍,AI数据赛道跑出一家新独角兽
成立约18个月的AI训练数据公司AfterQuery正筹新一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开发AI智能体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和安全风险待解。
斯坦福教授直播训练535B大模型,模型训练背后的「黑箱」正在被打开?
斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去大模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。
癌症疫苗爆火后,mRNA再迎突破:新技术有望让RNA在体内“活得更久”
8月19日,Moderna与默沙东个体化mRNA癌症疗法试验有阳性结果,引发mRNA话题热议。次日,名古屋大学与富士胶片针对环状RNA开发新LNP递送系统并验证功能,触及RNA长期治疗关键问题。
世界模型一口气输出小时级视频不跑偏,开源了
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
从“开放模型”到“开放生态”,AI 开源进入下半场
近期,Meta 推出开放权重模型,而开放模型商业使用收费渐成趋势。AI 开源面临成本、边界等问题,竞争从模型能力转向基础设施选择。世界人工智能开源大赛关注模型应用,凸显开源生态建设重要性。