熵正则化」共找到 803 篇相关文章

算法论文8

半量工具,双倍效能:ARPO革新大模型强学习

大语言模型在多轮工具调用场景有挑战,传统强学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量token分布变设计自适应探索机制,降低工具调用成本且提升多轮推理性能。

深度学习自然语言处理
新闻资讯7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代冲突处理、推理部署成本优、开源项目挑战及 GPU 虚拟趋势等内容。

AI前线
算法论文8

NeurIPS 2025 Best Paper | 扩散模型不为人知的“时间差”:为什么先学会创作,后学会抄袭?

深度学习中,扩散模型能生成新图像且抗过拟合。巴黎高师和博科尼大学研究团队论文指出,这源于隐含的动力学正则,训练分两阶段,数据量增加会拉开‘泛窗口’,还给出数学解释。

深度学习自然语言处理
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理
产品应用8

这一次,天玑9500的端侧AI能力,友商赶不上了

9月22日,联发科推出天玑9500芯片,展示新形态端侧AI应用,推动端侧AI实用。其性能强、功耗低,还支持端侧模型训练。多家手机厂商将发布搭载该芯片的手机,展现新AI趋势。

机器之心
新闻资讯8

谷歌Gemini 3.2偷跑上线!2200行代码一镜到底,Claude/GPT坐不住了

发布会未开,谷歌Gemini 3.2 Flash网页端静默上线,编码实力强悍,代码量大幅提升。其核心技术是蒸馏与稀疏,推理成本大降。Gemini App集成第三方应用,谷歌I/O大会多款产品将曝光,此次发布对谷歌至关重要。

新智元
产品应用7

Anthropic 深夜发布 Claude Design,一句话生成 UI,百亿美元市值 Figma 股价跌了 4.6%

Anthropic 发布新产品 Claude Design,由 Claude Opus 4.7 支持,以研究预览形式向部分用户开放。它定位为设计师“搭子”,覆盖多设计工作流。网友评价高,但也有人指出其生成结果有同质问题,对传统设计工具冲击待察。

InfoQ
算法论文8

港大团队首创静电捕获术,实现纳米金刚石晶圆级规模集成

香港大学褚智勤团队与多方合作,首创基于静电捕获的方法,5分钟就能在8英寸晶圆上阵列排布单个纳米金刚石,良率达82.5%。该方法操作简便、成本低且与CMOS工艺兼容,有望推动纳米金刚石量子技术商业

DeepTech深科技
新闻资讯7

Teleport 报告:AI 安全事件频出,背后往往是过度授权

Teleport报告指出,为AI系统授予过度访问权限的企业,安全事件发生率是权限管控合规企业的4.5倍。身份管理体系建设跟不上AI落地速度,精细权限授予是关键,还给出搭建统一身份层等建议。

InfoQ
开源动态8

从0到1搭建生产级Agentic AI系统:踩坑心得

作者拆解GitHub上生产级Agentic AI系统项目,指出生产级AI系统要把‘稳定性’‘容错性’‘可运维性’融入代码。介绍了项目在环境配置、LLM调用容错、日志监控等方面的设计,还给出工程落地避坑指南。

CourseAI