「时间衰减奖励」共找到 617 篇相关文章
快手&中科院 | 提出多模态奖励模型:R1-Reward,比SOTA模型提升5%-15%!
多模态奖励模型对提升多模态大语言模型表现至关重要,但现有强化学习算法用于训练存在问题。快手、中科院等团队提出 R1 - Reward,在基准上比 SOTA 提升 5% - 15%,还在快手业务场景成功应用。
半世纪计算机理论僵局被打破!MIT科学家偶然发现:少量内存节省大量计算时间
MIT科学家威廉姆斯偶然发现,证明内存比大家认为的更强大,少量的内存与大量的时间一样有价值。他证明存在数学程序,可将算法转换成占用更少空间的形式,成果获好评。
矩阵乘法可以算得更快了!港中文10页论文证明:能源、时间均可节省
香港中文大学10页论文提出新算法RXTX,用于计算矩阵与其转置的乘积XXᵗ。该算法结合机器学习搜索和组合优化技术,能源可节省5%-10%,时间节省5%,对多领域有深远影响。
TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral
大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。
制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践
在数智化转型中,企业开展AI培训却难转化业务价值。极客时间与制造企业合作,用“线上+线下+实战”的OMO训练营,实现AI产品经理“能力复制”,成果获认可,模式可复制。
3 层人群定位 × 5 种赋能手段,企业全员数据能力提升指南 | 极客时间企业版
在AI重构商业规则的当下,数据能力是企业核心竞争力关键。极客时间针对企业数据人才培养痛点,打造全链条数据人才培养体系,分层赋能三类人员,提供多种培养方案和赋能手段助力企业升级。
《圣经》成书时间或被改写!AI竟发现《死海古卷》早于所罗门时代
科学家用AI重构《死海古卷》时间线,发现许多卷轴比原先认为的年代更早。AI模型Enoch结合碳14定年与笔迹分析首创定年方法,超越传统古文字学,还可能揭示圣经作者线索。
ICML 2026 开幕,清华团队获最佳论文奖,DeepMind 经典巨作拿下时间检验奖
2026年7月6日,第43届国际机器学习大会(ICML 2026)在韩国首尔开幕,投稿规模与录用总数破纪录。会上,清华黄高团队论文获杰出论文奖,指出扩散语言模型“灵活性陷阱”;还有多篇论文获荣誉提名,另有立场论文、时间检验奖等揭晓。
制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践
在数智化转型中,企业 AI 培训常难以转化业务价值。极客时间为某制造企业定制 AI 产品经理 OMO 训练营,以业务场景为导向,采用三阶段闭环培养模式,课程覆盖全链路,助企业培养人才、建立培养体系。
IJCAI-ECAI 2026 开幕:吴佳俊斩获「计算机与思想奖」,SMOTE 算法获首届时间检验奖
当地时间2026年8月18日,第35届国际人工智能联合会议(IJCAI - ECAI 2026)在德国不莱梅开幕。会上颁发多项大奖,如吴佳俊获“计算机与思想奖”,SMOTE算法获首届时间检验奖,还公布论文接收数据,推出早期职业焦点演讲。