「可迁移大脑」共找到 4468 篇相关文章

算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
算法论文8

谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”

谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。

量子位
产品应用8

全网爆火的龙虾总失忆?大佬亲自下场手搓解药,终结致命痛点

OpenClaw项目爆火,但龙虾存在「失忆」问题。TiDB联合创始人黄东旭发布免注册的永续记忆服务mem9.ai,解决其记忆痛点。它一虾一库、免注册、支持备份迁移等,还上线个人记忆空间,与OpenClaw官方架构深度配合。

新智元
开源动态7

Vibe Coding“血洗”开源,社区吵翻了:封杀菜鸡 AI 开发者?不如给维护者打钱!

多位研究人员在预印本论文中指出,氛围编码或摧毁开源生态,使官网访问量下滑、社区论坛使用量骤减。研究称要维持开源规模需改革维护者报酬方式,同时分析了其对开发效率、开源软件可持续性的影响,社区对此看法不一。

InfoQ
推荐文章7

LightX2V Ulysses Attention 实现学习笔记

本文记录了LightX2V中Ulysses Attention的实现方式与张量形状推导。在多模态/视频场景,其实现可概括为一种layout变换,还提供`enable_head_parallel`和`use_fp8_comm`选项,效果受运行环境等因素影响。

GiantPandaLLM
开源动态8

英伟达发布并开源Alpamayo:自动驾驶终于开始讲道理了|甲子光年

北京时间今天凌晨,英伟达在CES现场发布Alpamayo系列开源AI模型、仿真工具及数据集,旨在推动推理型自动驾驶汽车开发。其核心模型Alpamayo 1可展示决策逻辑,此次发布是英伟达在该领域开放程度最高的尝试。

甲子光年
新闻资讯7

中国算力方案:如何用有限资源做出无限可能?|甲子引力

2025年12月3日,「甲子光年」举办年终盛典,在算力产业专场,分析师王艺对话多位嘉宾,探讨中国算力方案。面对算力困境,嘉宾分享突破策略,还就关键瓶颈、技术路径等展开交流,认为具备场景洞察等优势才能持续突破。

甲子光年
新闻资讯8

刚刚,马斯克Grok 4.1低调发布!通用能力碾压其他一切模型

xAI 低调发布 Grok 4.1 并向所有用户开放,可多平台使用。该模型在真实世界可用性上显著提升,尤其在创造力等方面出色。它在多项评估中表现优异,通用能力领先,情感智能、创意写作佳,还降低了事实幻觉。

机器之心
新闻资讯7

“中国英伟达”,离上市只差临门一脚

摩尔线程、沐曦等国产AI芯片企业距上市仅一步之遥,部分已在港交所提交申请表。企业闯关IPO面临诸多挑战,成功可获资金,失败或“失血而死”。上市后有望造富,也面临市场竞争,最终谁胜出要看生态构建。

芯师爷
新闻资讯7

AI领域全新热门职业,岗位需求今年已增长逾800%

在AI技术飞速发展当下,「驻场交付工程师」(FDE)成连接实验室与市场关键角色。他们兼具算法能力与业务洞察,深入客户现场将抽象模型转化为可落地解决方案。国外企业纷纷扩充FDE团队,国内也开始有类似趋势。

新智元