「冷启动」共找到 282 篇相关文章
SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%
文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。
18.2K Star!macOS 丝滑跑Linux,一键容器、多架构支持,开发效率直接起飞!
介绍轻量级虚拟机管理器 `Lima`,它能在 macOS 上提供类似 WSL2 的体验,专注容器化工作流。支持多架构与多驱动,有开箱即用的容器化支持等特性,安装和使用简单。
AI“画饼”画不动了?从狂热到冷静,行业迎来大消化
AI正处关键转折点,炒作撞上现实。企业认清其能力边界,期望回归理性。虽有泡沫讨论,但AI已在部分领域产生影响。它迎来“iPhone 4时刻”,进入持续迭代阶段,放缓源于炒作与边际效益递减。
千支队伍争锋!首届「启智杯」算法大赛圆满落幕,助推AI应用落地
2025年5月20日启元实验室启动「启智杯」算法创新应用挑战赛,7月25日落幕。赛事设三大赛道,吸引1022支队伍参赛。华南理工大学、陕西师范大学、西北农林科技大学及中山大学团队分获冠军,方案为行业提供启示。
6小时复刻AI IMO金牌成果,蚂蚁多智能体新进展已开源
2025年IMO赛场,顶尖大模型起初表现不佳后有突破。蚂蚁AWorld项目团队6小时复现并开源DeepMind解题结果,给出可一键运行系统。AWorld证明多智能体协同优势,还介绍复现思路、核心优势及体验方式。
摩尔线程之后,又一家国产 GPU 独角兽完成上市辅导
6月23日,国产GPU龙头沐曦IPO辅导完成,将提交申报材料。其为异构计算提供全栈GPU方案,产品有曦思N、曦云C、曦彩G系列。曾与书生・浦语3.0合作,2024年交付多个算力集群。此外,国产GPU厂商纷纷IPO。
A社旗舰Fable 5卖不动了。。两款神秘新模型已现身
支付平台Ramp统计显示,A社旗舰Fable 5上线两月销量不佳,收入仅占整体的11.4%。其价格高、性价比低,拖累公司收入未达预期。同时,X上出现Claude的两个神秘内测代号,或几周内上线。
让Agent真正“行动”起来,Agent Skill开发者大赛火热报名中!
人工智能下半场聚焦‘行动’,Agent Skill成关键桥梁。Agent Skill开发者大赛今日启动,由AIGC开放社区与算泥社区联合主办,设双赛道,有官方支持和丰厚奖励,报名通道已开启。
不换GPU,性能飙升2.8倍!英伟达用软件暴打摩尔定律
2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行多项优化。
跳出超级 App 之争,鸿蒙系统级智能如何改写 AI 赛道规则?
2025年AI热潮转向落地场景深耕,华为鸿蒙在终端操作系统层面开辟新赛道。其通过鸿蒙智能体框架打破‘APP孤岛’,走‘C+B’差异化路线,还推出开放平台等繁荣生态,推动终端智能化迈进。