飞机概念设计」共找到 1625 篇相关文章

产品应用8

华为 | MoE推理「王炸」组合:昇腾原生盘古推理,性能狂飙6-8倍!

华为团队推出昇腾平台原生Pangu Pro MoE 72B模型,经系统级软硬协同等优化,推理性能提升6 - 8倍。还提出分层混合并行等策略,打造融合算子,设计推理算法,在昇腾不同平台展现卓越性能。

AINLPer
开源动态8

Qwen3新成员:Embedding系列模型登场!

今天正式发布Qwen3-Embedding系列模型,专为文本表征等任务设计,继承Qwen3多语言理解优势。在多项基准测试表现卓越,已在多平台开源,有卓越泛化性、灵活架构与多语言支持等特点。

通义千问Qwen
算法论文8

MIT & Google | 提出异步并行生成新范式,LLM推理效率大幅提升!

MIT与谷歌团队在研究PASTA中探索异步生成范式,开发标记语言PASTA - LANG,采用双阶段训练流程,设计推理系统。实验显示PASTA平衡性能与质量,有可扩展性,为LLM推理效率优化开创学习驱动新路径。

AINLPer
新闻资讯8

微软Build 2025大会Day 1:All in「智能体网络」,全面推动MCP

北京时间昨夜今晨,微软Build 2025开发者大会Day 1开场,CEO萨提亚·纳德拉透露“智能体网络”概念。大会展示微软在开发者工具、办公中枢、云平台等多方面进展,还宣布Microsoft Discovery平台加速科学突破。

AI寒武纪
算法论文8

DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!

清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。

机器之心
新闻资讯7

今天起全员免费!GPT-4.1上线ChatGPT,首波实测:又快又听话,油腻感没了

今天凌晨起,GPT - 4.1可在ChatGPT中供所有用户使用。它专为编码任务和指令执行设计,推理效率高。首波实测反馈速度快、需明确指示且更清爽,性价比高,是日常编码的好选择。

量子位
算法论文8

Learning from peers!让LRM互相「传纸条」的新协作方式大幅提高准确率和效率

当前主流大模型如QwQ - 32B存在“前缀主导陷阱”,推理开头出错会使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越大模型,开创了多种可能性。

深度学习自然语言处理
开源动态8

SGLang Team:在 96 个 H100 GPU 上部署具有 PD 分解和大规模专家并行性的 DeepSeek

本文介绍 SGLang 团队在 96 个 H100 GPU 上部署 DeepSeek 的方法。利用 PD 分解和大规模专家并行性,SGLang 实现高吞吐量,成本低。博客探讨并行设计、优化方法,所有组件开源,也指出了当前局限与未来方向。

GiantPandaLLM
新闻资讯7

癌症疫苗爆火后,mRNA再迎突破:新技术有望让RNA在体内“活得更久”

8月19日,Moderna与默沙东个体化mRNA癌症疗法试验有阳性结果,引发mRNA话题热议。次日,名古屋大学与富士胶片针对环状RNA开发新LNP递送系统并验证功能,触及RNA长期治疗关键问题。

DeepTech深科技
推荐文章7

越靠经验思考的岗位,越先被取代!OpenHex董舒:AI数字员工正在催生OPC一人公司

OpenHex董舒认为AI最大价值是替人出面干活,提出数字员工概念。他指出判断力密度高的岗位易被AI取代,中国服务业有发展机会。还辨析数字员工类型,介绍其平台OPS Agent,最后分享了数字员工相关Q&A。

AI科技大本营