「高带宽域架构」共找到 3539 篇相关文章
具身Scaling Law押对了!独角兽新品1小时学会新任务,重复1800次成功率99%
具身智能独角兽Generalist推出新模型Gen - 1,它在精细任务上表现出色,成功率大幅提升、效率加快,验证了机器人领域的Scaling Law。研发团队重写数据处理架构,采用新技术提升性能。
360 如何用 AutoMQ 解决千亿级 Kafka 冷读难题
360 集团作为互联网安全公司,业务数据规模膨胀,Kafka 集群运维难题凸显。AutoMQ 存算分离等特性适配 360 需求,360 验证其性能后用于日志检索平台,解决冷读难题,未来将推广到更多业务线。
Cursor自研新模型反超Opus 4.6,价格还“打一折”!网友实测:只有它写完应用能一次跑通
Cursor发布第二代编程大模型Composer 2.0,在关键编程基准测试上反超Claude旗舰模型Opus 4.6,价格还“打一折”。网友实测其写完应用能一次跑通,效率和成本优势明显。但Cursor面临代码编辑器地位下降的危机,正积极自救。
把 MiniMax M2.7 扔进真实业务里:它替我省了 BI 和程序员的钱
作者测试 MiniMax M2.7,用含复杂数据的 Excel 测试其办公能力,让其开发管理系统验证工程能力,还测试 MaxClaw 多步骤 Agent。结果显示它表现出色,但处理复杂事件仍待优化。
OpenAI 官方博客:用技能(Skills)加速开源项目维护
OpenAI用Codex改变维护OpenAI Agents SDK仓库方式,通过仓库本地技能、`AGENTS.md`文件和GitHub Actions,将工程工作变为可重复工作流,提升开发效率,还介绍了配置、技能架构及使用注意事项。
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程
丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。
补齐OpenClaw进化拼图!AReaL v1.0开源,智能体强化学习「一键接入」
2026 年 Agent 仍是热门赛道,OpenClaw 热度持续。但 Agent 强化学习训练缺乏成熟体系。蚂蚁和清华联合打造的 AReaL v1.0 开源,实现 Agent 一键接入 RL 训练,还革新了训练引擎,降低开发门槛。
数据邪修大法好:仅用文本数据就能预训练多模态大模型
多模态大模型研发中,行业认为无图文对就无多模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。
英伟达护城河被AI攻破,字节清华CUDA Agent,让人人能搓CUDA内核
近日,字节跳动Seed团队和清华AIR的CUDA Agent引发轰动。它能编写经优化的CUDA内核,性能超torch.compile等。研究发布CUDA - Agent - Ops - 6K数据集,介绍系统管线设计、训练流程,实验结果佳,但有未对比复杂编译器等局限。
模型声称会“脑补”,结果被论文打脸了?潜在空间想象竟是“摆设”!
多模态大模型中“潜在视觉推理”概念很火,研究者让模型在潜在空间“想象”。但清华和北交学者论文指出,潜在 Token 不关心输入、不影响输出、没信息量。作者提出 CapImagine 方案,效果远超潜在空间方法。