高质量专注」共找到 2400 篇相关文章

推荐文章8

性能计算群星闪耀时

本文介绍了性能计算(HPC)在大模型时代的重要性,以及清华性能计算团队在HPC及相关领域的研究与实践。如郑纬民带领团队突破存储技术,陈文光、翟季冬等助力大模型训练,武永卫团队优化推理,张悠慧探索类脑计算。

芯师爷
算法论文7

低延迟、吞吐,LLM优化与效推理引擎综述

LLM计算成本,用户要低延迟,企业要吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机端推理、新型架构支持等进化方向。

深度学习自然语言处理
算法论文7

视觉优势还是语义依赖?揭秘 DeepSeek-OCR 压缩率背后的真相

中科院等团队论文剖析 DeepSeek - OCR,通过实验揭示其压缩率下准确率或依赖语言先验。去掉语言先验,准确率暴跌;下游任务推理崩塌,长文本处理也有瓶颈。

深度学习自然语言处理
算法论文7

ImageNet分数越,生成反而越糊?iREPA给出解释

Adobe Research论文指出,视觉模型在ImageNet分类准确率,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量

新智元
算法论文8

1句话质量生成游戏3D动作,北大新方法刷新动画制作SOTA

北京大学提出ReMoMask:基于检索增强生成的Text - to - Motion框架,集成三项关键创新。在标准基准测试上,相比RAG - T2M,在HumanML3D和KIT - ML上FID分数分别提升3.88%和10.97%。

量子位
算法论文8

字节Seed提出序贯策略优化方法,突破同传“质量-延迟”权衡问题

AI字幕质量和延迟难平衡是业界老问题。香港中文大学、字节跳动Seed和斯坦福大学研究团队提出序贯策略优化框架SeqPO - SiMT,在70亿参数规模实现SOTA,翻译质量媲美Qwen - 2.5 - 7B离线水平。

量子位
产品应用8

蚂蚁集团扩散大语言模型新突破:超800Token/s,速度与质量兼得

蚂蚁集团将LLaDA更新到2.1,通过引入“草稿 - 编辑”机制,打破扩散模型推理速度与质量的对立僵局。它有极速和质量两种模式,还采用混合训练流程及强化学习,在多基准测试中表现出色。

AIGC开放社区
算法论文8

ICML spotlight | 一种会「进化」的合成数据!无需上传隐私,也能生成质量垂域数据

大模型发展使数据短缺问题加剧,特殊领域更严重。为此提出合成数据自主进化框架PCEvolve,只需少量标注样本,就能在保护隐私同时进化出数据集,还介绍了其架构、选择器设计及实验结果。

机器之心
新闻资讯7

为什么「价值任务」成了所有 AI Labs 的T0 级战略?| 拾象 AGI 备忘录

过去一季度模型进步显著,头部 AI labs 战略对齐,将 coding 列为 T0 级战略,争抢价值任务。文中还探讨了 AI 对企业 SaaS 的冲击、ToC/ToB 二分法的过时、硬件挑战及价值任务的二八结构等问题。

海外独角兽
新闻资讯7

独家|地平线前管牛建伟成立叮当动力,专注空间智能,获地平线领投数千万元投资

《AI科技评论》独家消息,前地平线智能座舱产品线总经理牛建伟创立叮当动力,专注空间大模型的通用具身智能,获地平线领投数千万元种子轮融资。牛建伟经验丰富,团队提出独特解决方案,产品聚焦多元场景。

AI科技评论