「状态基础设施」共找到 539 篇相关文章
聊聊 Token 出海的生意经:模型开源给世界,中国赚什么?
本文围绕中国开源模型展开,介绍了 Cursor 使用 K2.5 模型事件,阐述了开源模型供应链,分析了中国开源模型受欢迎原因,探讨小公司技术机会,还提及开源面临的挑战及未来趋势,指出其正改变全球 AI 基础设施格局。
上海 AI Lab 庞江淼:开放平台是具身智能“ChatGPT 时刻”的前提|具身先锋十人谈
上海AI Lab庞江淼认为开放平台是具身智能“ChatGPT时刻”的前提。他早期专注CV,后转型切入底层控制。他指出具身智能Scaling Law非简单线性,还探讨了大小脑融合、VLA技术等,团队发布的Intern - Robotics目标是建开放基础设施。
30人团队震撼英伟达!Jim Fan自曝三个教训,重押世界模型
英伟达Jim Fan带队创立GEAR实验室,30人团队产出惊人,涵盖机器人学习完整技术栈。团队有GR00T基础模型等成果,Jim Fan还分享三个教训,重注视频世界模型,提出仿真世界三阶段,指出物理AI未来是新基础设施。
英伟达为何持续押注VASTData?AI存储正在成为新的“算力”|甲子光年
AI产业曾聚焦GPU,如今数据存储设施重要性凸显。VAST Data完成约10亿美元F轮融资,估值300亿美元,英伟达持续跟投。它重构AI数据基础设施,国内焱融科技有相似技术路线且具自主可控优势。
单张消费级显卡也能参与大模型训练!无问芯穹用「三个盒子」打通十万卡到一张卡AI效能跃升路径
2025年WAIC上,无问芯穹联合创始人夏立雪带来AI落地新解——三个盒子,即无穹AI云、无界智算平台、无垠终端智能,是面向未来的智能基础设施设计,能打通从十万卡到一张卡的AI效能跃升路径。
还在拼命加 GPU?AI 应用规模化的下半场,拼的是这五大软件“新基建”
文章指出 AI 应用规模化下半场,拼的是五大软件“新基建”。从云原生到 AI 原生,应用基础设施面临诸多挑战,如从代码中心到智能体管理等。作者提出构建智能体协作网格、认知记忆平台等五座技术灯塔,助力 AI 原生应用发展。
哈工大、中科院等利用模型“潜意识”提高推理模型效率,0.6B撬动复杂推理
哈工大、中科院等提出TrajSelector框架,让推理模型‘倾听内心独白’。它利用模型隐藏状态,用0.6B轻量级验证器实现比7B裁判模型更精准选择,在数学竞赛基准测试中表现出色,还能离线筛选数据,但在开放域问答有难题。
从MiniMax到DeepSeek:为何头部大模型都在押注「交错思维」?
昨日推特博主公布国内几大开源模型在 mini - SWE - agent 测试成绩,MiniMax 新一代大模型 M2 表现最佳。其采用的「交错思维」技术成亮点,解决了状态漂移问题,正成高性能 Agent 模型标配。M2 既强又省,还给出使用最佳实践。
下一站AI创业主线:别卷模型了,把这件事干成才重要
在AGI Playground 2025上,极客公园张鹏与三位投资人探讨Agent时代投资。他们认为AI创业进入「拼交付」时代,多模态短期影响被高估、长期潜力被低估,通用Agent是巨头之争,垂直Agent是创业机会,还会催生新基础设施,付费模式向按结果付费演变。
Transformer死角,只需500步后训练,循环模型突破256k长度泛化极限
线性循环模型能处理极长序列,是相比Transformer的关键优势,但过去循环模型性能不足且难以泛化。CMU等研究者证明,通过简单训练干预,循环模型500步后训练可突破256k长度泛化极限。