「计算效率」共找到 1773 篇相关文章
DeepSeek-OCR降本增效,10×暴力压缩还能读得清
Deepseek - OCR模型发布,通过光学压缩技术解决长文本处理的计算效率问题,能控制大模型token消耗成本。介绍了其架构设计、数据引擎及训练流程,还展示其用较少token超越现有模型的能力。
登顶Hugging Face GAIA全球榜首!中兴超级智能体终结「AI黑盒」时代
中兴通讯研发的超级智能体Co - Sight 2.0登顶Hugging Face GAIA全球权威榜单。它解决传统智能体痛点,有全链路可信计算框架等创新架构,其智能体工厂和开放标准助力构建生态,展现了智能体产业落地潜力。
上海AI Lab提出CANON:让RLVR自主识别优质推理模式
上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。
图解Vllm V1系列7:使用AsyncLLM做异步推理
文章因异步RL讨论热,探讨用vllm做最小程度异步二次开发。介绍如何用AsyncLLM做异步推理,分析单条请求处理流程及阶段,说明并发提升效率的方法,还提及多请求并发及构建异步推理引擎思路。
Gemini Flash/Lite 更新:更聪明、更快、更省钱
Gemini 2.5 Flash 和 2.5 Flash-Lite 更新,可在 Google AI Studio 和 Vertex AI 上使用。相比稳定型号,预览型号质量和速度提升,效率更高,分别减少一定比例输出令牌。两版本各有优势,如 Flash-Lite 指令遵循等能力提升,Flash 工具使用性能更好。
完成20亿的融资,这家AI芯片公司也要冲击IPO
近日,AI芯片企业清微智能完成超20亿人民币C轮融资,已启动上市筹备。该公司是可重构计算领导企业,量产多款芯片,与智源研究院合作打造国产AI芯片软件生态,市场表现佳。
Pingpong Schedule并不是万能钥匙
SGLang社区开发者反馈,SM90 FP8 Blockwise Scaling Grouped GEMM从H20迁移至H800后性能下降。文章分析是Pingpong调度策略所致,因算力提升,其使TensorCore未充分利用、TMA效率低,建议用Cooperative策略。
全球首个全链式空间天气AI预报模型“风宇”!国家卫星气象中心牵头,联合南昌大学、华为共同研发
当前太阳活动高发,传统空间天气预报难满足需求。2025年7月26日,国家卫星气象中心牵头联合研发的“风宇”模型发布,它是全球首个全链式空间天气AI预报模型,提升了我国空间天气预报能力。
TRAE Work 上线 Design 模式:产品经理还需要 Figma 吗?
TRAE Work 上线 Design 模式,可将一句话描述变成可编辑设计稿,还能将设计稿转代码,在同一平台完成从需求到代码的链路。作者测试后发现其效率大幅提升,并分析了该模式与其他工具的区别及 AI 设计趋势。
抗干扰能力提升近40% !无需对抗训练,北航上海AI Lab新蒸馏方法提升模型鲁棒性 | ICML 2025
在人工智能模型规模持续扩大的今天,数据集蒸馏方法能提升训练效率、降低成本,但蒸馏模型在安全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源。