「性能成本平衡」共找到 3301 篇相关文章
腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合
腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。
腾讯版Claude Design来了:多人实时同屏审设计稿,一键转代码直通IDE
腾讯公测AI设计智能体平台Ardot,有一句话生成可编辑UI设计稿、Figma文件零成本导入、一键转代码直通IDE、多人在线评审等功能。它能提升前期出稿效率,支持局部精准微调,适配主流IDE。
VLA大模型做长任务总断片?同济KC-VLA用关键帧链给治好了
VLA大模型记性是短板,处理非马尔可夫任务常束手无策。同济大学等提出KC - VLA框架,用关键帧链接赋予机器人全局时间感知能力,还构建了长时序记忆依赖基准测试,实验显示其性能优越。
对抗KV Cache压缩的脆弱性:两行代码以最坏风险控制防御底层假设崩塌
中科大团队在 ICLR 2026 论文中指出 KV Cache 压缩领域底层假设存在缺陷,主流方法基于的稳定性假设在真实场景中脆弱。团队提出防御性聚合策略,仅两行代码修改,显著提升 KV Cache 压缩性能。
DeepMind 颠覆机器人学习范式:让机器像人一样 “自由成长”
谷歌DeepMind受大模型微调中强化学习阶段启发,提出面向机器人学的两阶段后训练方法,含监督微调与自我提升。实验显示该方法让机器人自主习得新技能、广泛泛化,但研究也存在标注成本高等局限。
阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型
LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。
Meta归来!时隔一年发布Muse Spark,重回第一梯队
Meta发布Muse Spark模型,这是MSL团队首款模型。此前Llama 4表现不佳,刺激Meta重组。Muse Spark性能超Llama 4,计算效率提升,在测试中成绩优异,Meta AI战略转向闭源探索,模型已上线。
【倒计时一周】AI眼镜芯生态沙龙:从芯片到整机的协同创新
当智能手机创新遇瓶颈,AI眼镜成新风口。当前市场高速增长,但面临技术、成本、场景和产业链协同等难题。本次沙龙旨在凝聚产业链共识,解决发展难题,共探产业未来,为各方提供合作契机。
刷榜自动驾驶语义场景补全!北大新作:高维度、高密度 | AAAI'26
北京大学彭宇新教授团队提出视觉语义场景补全方法HD² - SSC,通过高维度语义解耦和高密度占用优化,解决现有技术维度与密度差异问题,在两自动驾驶数据集上取得最优性能。
仅用1/9的token拿下SOTA,用LLM当知识路由:全新RAG框架DeepSieve
大语言模型遇「最新」或「垂直领域」知识易出错,传统RAG做法有痛点。全新RAG框架DeepSieve把LLM当知识路由器,四步筛选信息,实验精度高、成本低,消融实验明确各模块价值,还有救场案例。