「自主智能测试」共找到 5147 篇相关文章
让GPU不再摸鱼!清华蚂蚁联合开源首个全异步RL,一夜击穿14B SOTA
清华与蚂蚁联合开源AReaL - boba²,实现全异步强化学习训练系统,解耦模型生成与训练流程,大幅提升GPU利用率。14B模型在多个代码基准测试达SOTA,性能接近235B模型。
AI生图迎来大升级:图像编辑达到像素级!背后团队大多来自Stable Diffusion模型基础技术发明团队
Stable Diffusion缔造者团队创立的 BFL 发布全新图像生成模型 FLUX.1 Kontext,可实现像素级图像编辑。它能以文本和图像为输入,有 Pro、Max、Dev 三版本,已在多平台上线,获用户好评,但也面临竞争。
让AI学着“看菜下碟”!港中大等新框架让推理长度减少90%,准确率反增17%
香港中文大学等研究者提出TON选择性推理框架,使视觉语言模型能自主判断是否推理。该框架有两阶段训练机制,实验显示其让推理长度最多减90%,准确率还提升,有益模型部署。
每2秒吃透一道高数大题!华为终于揭秘准万亿MoE昇腾训练系统全流程
华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现大模型高效训练。
扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧
上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。
AI编码新神登基,藏师傅一手Claude 4实测
Claude 4低调发布,Anthropic称Claude Opus 4是全球最佳编码模型。发布内容含扩展思维、新模型能力等,还公布定价。Claude Opus 4编码和记忆能力强,实测表现出色,Claude Sonnet 4也有提升且免费。
震撼全网,AlphaEvolve矩阵乘法突破被证明为真!开发者用代码证实
开发者用Claude写代码证实谷歌DeepMind的AlphaEvolve求解矩阵乘法的突破为真,它将4×4复数矩阵计算次数从49次减到48次。小哥测试代码各项指标与论文报告一致,还上传到GitHub。
实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型
今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。
突发!Opus 5.2深夜上线,RSI真来了?
Anthropic在Claude Code开启Claude Opus 5.2灰度测试,跳开5.1版本,解决了以往AI“偷懒病”,响应速度、输出质量大幅提升,同时曝光内部已用核武级Model 2编写代码,RSI或已来临。
没有全科优秀,具身模型别想进入百万小时
文章介绍权威评测 RoboDojo,给全球机器人模型办‘高考’,多数具身模型离落地远。原力灵机的 DM0.5 模型登顶,它记忆能力强、全科优秀,且全面开源,有望推动具身智能发展。