智能大屏」共找到 7389 篇相关文章

算法论文8

10行代码,AIME24/25提高15%!揭秘模型强化学习熵机制

来自多机构的研究者揭示模型强化学习中熵变化机制。发现策略熵在训练中急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,在部分数据集上性能提升显著。

机器之心
新闻资讯7

Claude灾难级宕机,全球开发者集体炸锅!Anthropic三连翻车被怒喷

4月6日Claude新功能Ultraplan上线就遭遇规模宕机,开发者看到满‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗,Anthropic太急,产品稳定性堪忧。

新智元
开源动态8

荣登HuggingFace周榜首位, 人高瓴与快手提出ARPO实现智能体高效训练!

高瓴与快手提出的ARPO项目受高度关注,荣登Huggingface Paper日榜、周榜双首位。它是为多轮交互型LLM智能体设计的强化学习算法,在基准测试中,用一半工具调用预算就显著优于现有方法。

PaperAgent
算法论文8

华为多路径推理破解模型数学瓶颈,准确率超97%|ICML 2025

模型处理复杂问题常“翻车”,华为诺亚方舟实验室提出思维森林(FoT)框架,借鉴人类认知方式,打破线性推理范式。FoT在多个数学推理任务表现出色,准确率超先进模型,将在ICML 2025开源。

量子位
新闻资讯7

Transformer八子初创:AI横扫NP难题竞赛,Top 2%选手竟是智能体!

Transformer作者Llion Jones初创公司测试AI智能体,其在NP难题竞赛中排第21。Sakana AI与AtCoder合作构建ALE - Bench,设计ALE - Agent参赛成绩优异,不过它也有调试难等局限,未来待改进。

新智元
7

星标超 29 万,OpenClaw 两天两次更!适配GPT 5.4,告别“抽卡式 Prompt”

GitHub星标超28万的AI Agent开源项目OpenClaw,在周六与周日迎来两轮重量级更新,集中在模型能力、Agent架构、工程部署及安全机制四个方向。2026奇点智能技术会将邀专家探讨其产业实践价值。

AI科技大本营
开源动态7

SGLang × RoleBasedGroup(RBG):打通模型推理PD分离架构规模化落地的“最后一公里”

PD分离架构对模型推理部署意义重,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。

InfoQ
算法论文8

所有模型,都学物理学:北物理系一篇研究,震撼了AI圈

等机构团队跨界用物理学最小作用量原理,提出新颖方法估计 LLM 生成方向性,揭示其背后‘物理定律’。发现 LLM 生成有细致平衡现象,还能用物理指标给模型画像,让 AI 研究提升到‘物理科学’高度。

机器之心
产品应用8

网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 模型推理加速架构

网易游戏打造 Tmax AI 机器学习平台,但模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。

AI前线
新闻资讯8

模型七连发,外国人馋透了!阿里云栖会全栈升级够狠

阿里在2025云栖会全栈升级,发布七款通义新模型,从基础模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心