长链执行」共找到 1424 篇相关文章

开源动态8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5,提供文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。

AINLPer
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定时记忆

中国人民大学团队提出全新LLM记忆管理框架MemSifter,打破时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。

深度学习自然语言处理
算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应短思维机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
产品应用8

捅破具身智能天花板!极佳视界新VLA大模型登场,复杂时程任务近100%成功率

极佳视界推出GigaBrain-0.5M*VLA大模型,以世界模型条件驱动,引入人在回路持续学习机制。在与主流方法对比中,任务成功率提升30%,时程任务近100%成功,还具备高效准确的价值预测能力。

量子位
产品应用8

面壁MiniCPM4端侧模型发布:文本推理 5 倍提速,0.5B 模型拿下新SOTA

2025智源大会,面壁发布MiniCPM4.0端侧模型,含8B稀疏闪电版与0.5B款。其采用InfLLM架构,实现文本推理5倍提速、最高220倍加速,还在性能、部署等方面优化,适配多芯片与框架。

AI科技大本营
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端时记忆

机器之心发布文章介绍,大模型期记忆能力受限于上下文度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M度的大模型时记忆框架。

机器之心
开源动态8

国产类脑大模型适配国产沐曦GPU!序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。

量子位
产品应用8

文本推理 5 倍提速!面壁MiniCPM4 端侧模型发布,0.5B模型效果秒杀同级

近日,面壁发布 MiniCPM4.0 端侧模型,有 8B、0.5B 两种规模。其在基准测试表现出色,文本推理提速,缓存锐减,还做了架构创新。此外,面壁有自研推理框架,科学化建模产线,6 月 27 - 28 日 AICon 北京站将探讨 AI 趋势。

AI前线
产品应用8

大神Karpathy都投的AI实时视频生成模型:直播都能立即转,无限时几乎零延迟

AI初创公司Decart推出首个零延迟无限实时视频生成的AI模型MirageLSD,大神Karpathy都投资了。它能实时生成视频流,无时限制且延迟低至40毫秒以下,还攻克了传统模型‘误差累积’难题。

量子位
开源动态8

李飞飞50亿美金赛道被开源!浙大教授章国锋带队创业,打造无限时实时3D世界模型

2024年李飞飞创立的World Labs入局空间智能赛道,估值达50亿美元。近日影溯发布并开源实时帧生成模型InSpatio - WorldFM,由章国锋领衔,该模型突破2D局限,效率高、能无限时推理,展现出高工程可用性。

机器之心