最优传输」共找到 150 篇相关文章

产品应用7

快手提出强化学习创新框架RLEP,突破大模型推理瓶颈

OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升大模型训练效率和性能。

AIGC开放社区
新闻资讯7

Karpathy戳破强化学习神话,首提AI复盘式进化!暴力试错将死

AI大神Karpathy发文指出强化学习(RL)有局限,效率随任务时长下降,与人类学习机制差异大。他提出复盘式进化Scaling范式,虽有很多细节待完善,但认为还有更多S型增长曲线待发现。

新智元
开源动态7

怀疑人生!!!程序员真被整不会了,27.2k Star FastMCP

文章介绍了27.2k Star的FastMCP,它是Python MCP应用框架,能让普通Python函数成为MCP工具。讲了其适合场景、省事原因及上线安全边界,还给出了适用人群和注意点。

小华同学ai
算法论文8

大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。

量子位
新闻资讯7

近亿元融资落定!隼瞻科技加速芯片设计"敏捷革命"

近日,隼瞻科技完成近亿元天使+轮融资,多家知名战略投资人加入,老股东继续加持。该公司是国内唯一‘IP货架 + EDA工具’双轮驱动企业,自研平台可大幅缩短设计时长,成立三年已迈向规模化落地。

芯师爷
算法论文8

让RAG真正读懂“言外之意”!新框架引入词汇多样性,刷新多项基准SOTA

ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇多样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验在多基准提升准确率,还将在多模型上增益,代码即将开源。

量子位
开源动态8

微软 SkillOpt:不动模型权重,只训练那份「技能说明书」

微软研究院 Yifan Yang 等人推出 SkillOpt,思路反直觉,不动模型权重,把「技能文档」当可训练参数。它在 52 个组合中表现最优,技能可迁移,代码已开源,还支持多操作。

AI工程化
新闻资讯7

印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来

智能驾驶行业激战正酣,千里科技与阶跃星辰合作打造“原生智驾基座模型”。印奇首谈双公司布局,认为中国AI商业闭环要靠车跑出来。千里科技收入、利润双增,智驾装机规模将超百万辆,还布局Robotaxi和超级智能体。

InfoQ
算法论文7

外国科学家从汉字中找到了设计超强材料的灵感!“天”字形材料最坚固

4月21日爱丁堡大学研究人员在《应用物理学杂志》发文,将“人”“大”“天”“夫”字形转化为超材料结构单元,经压缩实验发现汉字字形中藏力学规律,“天”字形材料性能最优

DeepTech深科技
算法论文8

DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代稀疏模型提前剧透

DeepSeek最新论文给Transformer加上“条件记忆”,补上原生知识查找机制。梁文锋署名,与北大团队合作。提出全新范式及Engram模块,解决传统N - gram问题,研究稀疏性分配,验证推理能力提升,兼顾工程优化。

量子位