不读博音乐节」共找到 1325 篇相关文章

算法论文7

Qwen3 变身扩散语言模型?从零训练也能跑,30B参数创纪录

扩散语言模型(DLM)潜力大但训练难,Radical Numerics团队改造Qwen3-30BA3B,推出30B参数的开源扩散语言模型RND1-Base。该研究系统性研究A2D转换关键因素,成果超现有部分模型,还提出简单方法及训练策略。

机器之心
开源动态8

让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源

清华AIR、字节联合团队曾发布DAPO实现大规模LLM强化学习。刘力源、姚峰团队发现DAPO-32B中rollout生成是瓶颈,推出FlashRL,应用INT8/FP8,用TIS解决匹配问题,加速显著且牺牲性能,一条命令即可使用。

机器之心
算法论文7

研究表明:资深开发者在使用AI工具时,完成任务的时间比使用时延长了19%。

研究通过随机对照试验,发现2025年初资深开源开发者使用AI工具完成任务时间比使用时延长19%。当前衡量AI能力多依赖标准化评测,可能高估或低估其真实能力,研究旨在更准确评估。

宝玉AI
新闻资讯7

Anthropic 联创曝内部工程师已写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?

Anthropic联合创始人透露公司工程师已写代码,通过管理AI Agent系统写代码,工作量达原来2 - 3倍,还提议向AI公司征税。但开发者质疑Claude存在诸多问题,认为AI写代码未到革命地步。

AI前线
推荐文章7

到底是谁在推崇 Nature、Science?——一场跨学科评价体系的结构性误解

文章指出同学科对 Nature、Science(N/S)态度差异大,基础学科看重,应用学科推崇。原因在于学科生态差异,N/S 是传播器,下游学科需其传播成果,大奖评价与 N/S 体系同,国内应将其‘工具化’。

力学与人工智能
新闻资讯7

Anthropic 联创曝内部工程师已写代码了,但工作量翻倍!开发者嘲讽:所以 Claude bug才那么多?

Anthropic联合创始人透露公司工程师已写代码,而是管理AI Agent系统,工作量达以往2 - 3倍,Claude也参与编写自身代码。Dario提议向AI公司征税,开发者对AI写代码存质疑,还提到AI测试作弊等情况。

InfoQ
推荐文章7

自研、只收购,年入7亿美金,全球最赚钱的应用工厂是如何做成的?

Bending Spoons是欧洲非游戏类应用工厂,靠收购模式年入7亿美元。创始人Luca Ferrari称收购是买时间和优势,解锁被收购公司潜力。公司核心竞争力是内部系统,还回应了裁员争议,也谈及未来规划。

Founder Park
算法论文8

奖励模型新革命!SWIFT读文本读“心声”,打造又快又强又省钱的AI裁判

传统Best-of-N方法中的奖励模型成本高、速度慢,限制技术普及。上海交通大学等校研究者提出轻量级技术SWIFT,直接监听模型内部隐藏状态判断信心,效率、准确率等表现出色,为AI发展提供新范式。

AINLPer
推荐文章8

DevOps之父:发几个Claude Code账号就叫AI转型?Agent用好是公司的锅

DevOps 之父 Patrick Debois 认为,企业 AI 转型能仅停留在给开发者买工具,Agent 效果佳,问题或在公司。开发者要转变思维,改进产出代码的系统,组织要围绕 Agent 重构协作方式。

InfoQ
新闻资讯7

大神Karpathy炮轰复杂UI应用没有未来,Adobe首当其冲,网友:提供文本交互,就是在阻挡AI浪潮

大神Karpathy预言只有复杂UI界面、提供文本交互的应用将被淘汰,还点名Adobe、CAD。他言论引发讨论,支持者强调后端接口,反对者认为专业软件有其价值。此外,他还批判大模型编程‘重生成轻判别’。

量子位