算法瓶颈」共找到 1115 篇相关文章

开源动态8

攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0

9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。

机器之心
算法论文8

半量工具,双倍效能:ARPO革新大模型强化学习

大语言模型在多轮工具调用场景有挑战,传统强化学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量化token熵分布变化设计自适应探索机制,降低工具调用成本且提升多轮推理性能。

深度学习自然语言处理
开源动态8

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。

新智元
推荐文章7

Cursor CEO:拉开人与人之间差距的,是品位!

文章总结了Cursor CEO Michael Truell接受访谈的观点,包括未来写代码会落后、AI瓶颈在哪、Cursor自建编辑器原因、小众软件机会、品味的重要性,还提及Cursor的PMF和护城河,推荐看访谈视频。

花叔
新闻资讯7

全国大学生,苦 AIGC 检测久矣

央视报道,多位高校学生毕业论文被 AIGC 检测系统误判,甚至《滕王阁序》《出师表》也被标为高风险。检测原理主要依赖「AI 困惑度」和「突发性」。毕业季检测算法升级致结果大幅波动,引发学生不满。

特工宇宙
推荐文章8

全面解析 Agent Engineering 的 10 大工程维度:生产级 Agent 系统的炼成之路。

技术突破让AI智能体成热点,但应用走向真实业务暴露出工程瓶颈。本文围绕智能体工程及其10个核心维度,剖析从“不确定的LLM能力”到“可靠的生产级Agent系统”的炼成之路。

AI大模型应用实践
算法论文8

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式

上海人工智能实验室提出策略判别学习(POLAR)新范式,解决奖励模型设计与训练瓶颈。POLAR可灵活适配多样需求,弥补传统奖励模型短板,契合强化微调框架,实验证明其性能和泛化性优越。

量子位
开源动态8

社区供稿丨迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro

2月4日,上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0时代提供开源基座。其核心能力跃升,架构创新,协同通用与科学能力,还构建‘算力 - 算法’基座,高质量开源赋能生态。

Hugging Face
开源动态8

港大开源ViMax火了,实现AI自编自导自演

香港大学黄超教授团队开源ViMax框架,在GitHub获高星标。它借助多智能体协作实现AI自编自导自演视频,突破主流模型在长视频制作的瓶颈,采用多种策略应对技术挑战,不过在多方面仍有提升空间。

机器之心
新闻资讯7

现在整个AI投资逻辑都错了!微软CEO首次承认:成排的H100正在积灰,插不上电

微软CEO称AI行业投资逻辑有误,瓶颈已从芯片变为电力。微软大量H100因缺电力设施闲置,按芯片采购量为公司定价的模型是错的。真正赢家是早锁定电力协议的玩家,竞争护城河已改变。

AI寒武纪