「测试时训练」共找到 4023 篇相关文章
华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」
今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革新。
万卡时代,企业需要怎样的算力集群?
过去两年,AI算力需求跃升,消耗从训练主导转向推理驱动。企业算力需求有突发性等特点,智算集群是关键方案。InfoQ联合腾讯云发起直播探讨,还介绍了算力供给缺口、集群构建交付、性能优化及演进方向。
从 Apple M5 到 DGX Spark ,Local AI 时代的到来还有多久?
近期,黄仁勋将桌面级AI超算DGX Spark交付给马斯克引发热议。同时,Apple Silicon等芯片下放端侧推理能力,本地运行时和端侧模型供给加速成熟。但本地算力等问题仍制约消费终端Local AI大众化落地。
14万一台家务机器人!斯坦福华人博士具身创业首款产品亮相,用户还能买回去自己教
斯坦福华人博士赵子豪与迟宬创业推出家务机器人Memo,售价2万美元。它能完成多项家务,依赖ACT - 1具身模型,该模型用技能捕捉手套采集人类数据训练,用户还能教它新本领,预计2026年正式推出。
Gemini 3.0还在预热,中国AI抢先!30秒造APP全网首测
谷歌Gemini 3.0预热时,国内新生AI神器蚂蚁灵光上线。它能30秒造APP,实现“生成涌现”落地,以闪应用开启范式革命,用信息美学融合全模态,探索“摄像头+AI”新形态,让普通人提前感受未来AI世界。
黄仁勋称英伟达中国份额从95%降至0%
近日英伟达CEO黄仁勋出席美国城堡证券活动时表示,因美国出口管制,英伟达中国市场份额从95%降至0%,美国此举或也会伤害自身。他认为监管AI要深思熟虑,应平衡技术领先与吸引全球研究人员。
斯坦福、英伟达和伯克利提出具身Test-Time Scaling Law
斯坦福、英伟达和伯克利团队提出具身Test - Time Scaling Law。研究发现推理时增加计算量可提升VLA模型性能,揭示动作误差与采样数量幂律关系,还探讨关键问题,给出方法,实验证明结合RoboMonkey能显著提升性能。
上海AI Lab提出CANON:让RLVR自主识别优质推理模式
上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。
Andrej Karpathy深度解读:强化学习之父为何说大模型违背了「苦涩教训」
Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为大模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。
Sora 2 中国首测?Open AI 这次真成了!
OpenAI提前发布Sora 2模型,可克隆音色,支持多语言。还推出似AI版抖音的社交APP,免费生成视频。测试显示,它有世界知识,能多参生成、自动切镜头,在多方面表现出色,但版权限制严,部分一致性待提升。