「测试时扩展技术」共找到 4681 篇相关文章
扩散语言模型写代码!速度比自回归快10倍
Inception Labs推出基于扩散技术的大语言模型Mercury,它突破自回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且有强大纠错能力,但面临与当前CI能力不匹配问题。
苏度 WAIC 首秀:从1到10+技能跃迁,探索通用机器人 Scaling 路径
WAIC 2026上,苏度科技机器人展示了抓取物品等技能,稳定性等表现出彩。苏度成立一年获200亿估值,其创始人苏昊等技术实力强。它构建能力积累体系,采用虚实融合数据路线,坚持软硬件一体,多场景落地成果佳。
从deepseek v4的受限流线型超链接mHC谈架构优化
文章围绕DeepSeek v4的受限流线型超链接mHC探讨架构优化。指出过去十年深度学习重扩展层内计算,忽视层间通信。介绍多种层间通信改进方法,提出用检索替代累加,还提及深度注意力机制及混合深度注意力的成果。
不止Deep,更要Wide:清华、无问芯穹发布多智能体系统WideSeek-R1,4B模型比肩671B模型!
清华与无问芯穹的RLinf团队提出「广度扩展」,发布多智能体系统WideSeek-R1。它采用「Lead-agent-Subagent」框架,经MARL端到端训练,4B模型在广度搜索任务表现比肩671B模型,且在标准QA任务也出色。
Transformer 中的专家混合模型 (MoE)
文章介绍Transformer中专家混合模型(MoE),它能解决稠密模型扩展瓶颈。阐述其优势,如计算高效、适合并行等,还介绍在transformers库中支持稀疏架构的演进,包括权重加载重构、专家执行后端、专家并行及训练方案。
春天见,第 20 届 D2 如期而至
2026年3月14日,第20届D2技术大会将在杭州阿里总部举办,主题为「AI新」。大会设多场专场沙龙,涵盖AI写代码、改变体验等内容,还有夜场沙龙探讨终端与AI未来。此外,开放议题征集,公布了参会购票信息。
OPPO新AI操作系统,走出屏幕“指哪答哪”,嘈杂环境只听你声音
OPPO新一代AIOS ColorOS 16来了,“一键闪记”和“一键问屏”功能有新玩法。“一键闪记”能记取餐码等,还会“记忆共生”;“一键问屏”走出屏幕,嘈杂环境也能只听你声音。此外,OPPO宣布全新AI技术架构。
机器人“狂踹不倒”视频刷屏!太空舱遍布城市街巷,银河通用这几手秀麻了
银河通用发布全新通用动作追踪框架Any2Track,让机器人精确模仿人类动作,还能抗干扰。团队将动作捕捉学习解耦为两阶段,兼顾精准模仿与抗干扰。其银河太空舱让机器人融入生活,全栈自研技术推动具身智能落地。
最新!Sam Altman:GPT-5几乎所有方面都比我们聪明,准备好直面超级智能
OpenAI的奥特曼在播客中透露GPT - 5已在内部测试,其能力让他有无力感。他认为GPT - 5虽更聪明,但不意味人类价值终结,还提出环球基本财富构想,也坦言对AI影响的担忧。
老黄斥资60亿美元,打造全球顶尖开源模型!
多家外媒爆料,英伟达计划斥资60亿美元打造全球最强开源权重AI模型。为此,英伟达买下Poolside的技术,挖走其核心团队,追加巨额投资。这让AI大模型竞争格局或变天,英伟达也将与大客户成对手。