「传统算法」共找到 1570 篇相关文章
冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世
微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。
16岁炒马斯克鱿鱼,SpaceX天才转投北大数学校友赵鹏麾下
16岁天才Kairan Quazi从SpaceX离职,入职全球顶尖量化交易公司Citadel Securities。他曾14岁毕业于圣克拉拉大学,被马斯克选中加入SpaceX。他表示量化金融反馈快、结果直观,且新公司欣赏他的非传统背景。
ICML 2025 Spotlight|华为诺亚提出端侧大模型新架构MoLE,内存搬运代价降低1000倍
华为诺亚和北大研究人员提出端侧大模型新架构MoLE。它解决传统MoE显存开销大、传输延迟高问题,推理时将专家输入改embedding token,用查找表替代矩阵运算,实验显示性能与MoE相当,大幅降推理延迟。
中国科学家首创万能热缩电子皮肤,加热即贴合,怎么扭曲都不坏
中国科学院理化技术研究所国瑞研究员等联合团队发明“热缩”制造新方法,将半液态金属电路印在热塑性薄膜上,加热后能包裹物体表面,解决传统刚性材料电路失效问题,具高耐用性。
「你是专家」竟成AI幻觉毒药?新论文一巴掌揭穿提示词最大骗局
最新论文证实,「让AI装专家」会可测量、持续地降低模型的准确率。研究发现,Persona Prompting的效果依赖多因素,专家人设提升的多是「对齐感」。为解决问题,研究人员发明PRISM算法。
AI地理学家诞生:麻省理工、斯坦福用多智能体框架重塑地理空间建模,刷新SOTA
麻省理工、慕尼黑工大及斯坦福AI实验室发布GeoEvolve框架,深度融合地理知识与进化算法,实现复杂地理空间模型自动发现与优化。经实验验证,其性能超越以往基准,有望在多领域发挥作用。
老黄预言成真!全球首个AI原生游戏引擎,一句话秒出GTA级神作
谷歌、英伟达等八大机构联手发布全球首款AI原生UGC游戏引擎Mirage,无预设关卡,一句话即生游戏。它以实时交互‘世界模型’为核心,玩家可随心创造,体验远超传统游戏。
文本分类重大创新:持续学习新增类别,不会灾难遗忘
在生成环境中,传统文本分类方法新增业务标签需从头训练,易致知识灾难性遗忘。今天介绍的自适应分类器,通过四项创新,可实现动态类添加和持续学习,而不会发生灾难性遗忘。
SIGGRAPH 2025 | CLR-Wire:曲线框可生成?可交互?深大VCC带你见证魔法
深圳大学黄惠团队推出 CLR - Wire 方法,将复杂三维曲线框结构编码到连续潜空间,解决传统难题,能实现高效生成与平滑插值,相关代码已开源,在多领域有应用前景。
2026!开年关键词:Self-Distillation,大模型真正走向「持续学习」
2026 年刚开始,大模型领域研究者达成默契,arXiv 论文高频出现 Self-Distillation。传统强教师依赖范式难适配模型持续进化,Self-Distillation 成破局点。MIT 等机构发布三项研究成果,均用信息差实现模型自驱动升级。