实验闭环验证」共找到 2167 篇相关文章

算法论文8

ScreenCoder:视觉-代码对齐新范式,为多模态程序合成开辟道路

前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化多智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为多模态程序合成开辟道路。

深度学习自然语言处理
算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位
新闻资讯8

OpenAI连破10道数学难题,Fable 24小时「复现」5道

这个周末,OpenAI与Anthropic两大AI巨头在数学前沿短兵相接。先是OpenAI用未发布模型Astra证明10项数学成果,不到24小时,Anthropic的Fable复现了其中5项。AI解难题成本降低,成果验证成新考验。

新智元
算法论文8

视频生成太慢?英伟达、谢赛宁等发布TMD框架,实现70倍加速

大规模视频扩散模型采样效率低,应用受限。英伟达联合谢赛宁等提出TMD框架,将大型视频扩散模型蒸馏为少步生成器。实验显示,TMD能实现超70倍加速,质量损失小,用户也更偏好其生成的视频。

机器之心
算法论文7

中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型低资源代码能力

大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强低资源代码能力、缓解高资源语言遗忘上有效。

机器之心
开源动态8

当「变大」不再是唯一的路,又一国产模型开源了

2026年6月智谱开源GLM - 5.2,心洲科技前沿实验室Mind Lab开源Macaron - V1,基座升级至GLM - 5.2。它押注持续学习与群体智能,成绩优于基座,相关理念和工程路径获验证

机器之心
开源动态7

在一台1970年代的PDP-11上训练Transformer需要多久?答案是5.5分钟

近日,开发者复现1970年代技术环境,用PDP - 11汇编语言实现Transformer并训练成功,项目叫ATTN - 11。在低资源下实现功能闭环引热议,大家思考Transformer到底需要什么。

机器之心
算法论文8

不止修bug:Agentic Coding评测走向复杂feature交付新阶段

中国科学院自动化研究所联合华为提出 FeatureBench,构建端到端基础设施并开源。它从单元测试出发构造评测任务,引入多种机制保障任务可执行、可验证,能有效区分模型能力,还提供易用的评测流程。

机器之心
新闻资讯8

当世界在谈论AI替代人类时,松鼠Ai在达沃斯带回了什么答案?

2026年达沃斯论坛上,松鼠Ai创始人栗浩洋展示教育普惠新路径,其智适应学习系统成本低且效果好。该系统经科学与规模验证,还引发经济核算思考,其全球化发展受国际资本关注。

新智元
算法论文8

AAAI 2026 Oral | SplatSSC:解耦深度引导的高斯泼溅,开启单目语义场景补全高效新范式

单目3D语义场景补全领域长期受困于密集网格表征,现有‘对象中心’范式也有瓶颈。SplatSSC框架通过深度引导策略与解耦聚合机制,实现性能与效率提升,在实验中表现优异。

机器之心