混合群体策略优化」共找到 1170 篇相关文章

产品应用8

扔掉人工公式:快手EMER框架,用“会比较、自进化”的模型重构短视频推荐排序

过去十年,推荐排序多依赖人工设计公式,但此模式遇瓶颈。快手策略算法团队提出 EMER 框架,用“会比较、能进化的 AI 模型”重构短视频推荐排序,在快手主 App 和极速版效果显著,还为行业提供解决方案。

机器之心
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?

伊利诺伊大学香槟分校等多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心
算法论文8

其实,扩散语言模型在最终解码之前很久,就已确定最终答案

随着扩散语言模型(DLM)发展,它成自回归(AR)模型有力替代。但实际推理慢于 AR 模型。研究者发现早期答案收敛现象,提出 Prophet 策略,实验显示其能在保持高质量生成时显著加速推理。

机器之心
开源动态7

小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?

小红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。

InfoQ
推荐文章7

AI 时代的架构治理

本文指出在生成式AI时代,软件开发生命周期瓶颈转变为组织将创意转化为成果并保持架构凝聚力的能力。传统人工监督模式难应对,提出声明式架构策略,介绍其在事件模型、OpenAPI验证器等方面应用。

InfoQ
新闻资讯7

115万片晶圆,决定2026年的“芯片战”,苹果、联发科、OpenAI火线入局

2026年“芯片战”激烈,黄仁勋宣称90%的ASIC项目会失败。AI算力芯片出货格局取决于台积电CoWoS产能。英伟达有望拿近60%产能,GPGPU阵营火力强,ASIC用于特定场景,未来或现“GPU+ASIC”混合算力世界。

芯师爷
算法论文8

多模态后训练反常识:长思维链SFT和RL的协同困境

华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心
开源动态8

DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练量暴增10倍

DeepSeek正式上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强大智能体能力,编程击败Claude 4,训练量大幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。

新智元
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~

智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略

CourseAI
新闻资讯7

供需失衡的窗口期里,商汤大装置把国产算力做成了正毛利生意

WAIC期间,商汤大装置举办AI基础设施论坛,展示国产算力成绩单,将国产芯片业务毛利率做到正数。其通过异构混合推理等操作方法论,提升芯片利用率,还在多领域合作,虽红利或收窄,但方法论有长期价值。

量子位