精度与效率」共找到 7299 篇相关文章

算法论文8

无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」

清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率通用性痛点。

机器之心
开源动态8

北大联合Llama-Factory推出DataFlex:工业级数据动态训练系统

北大张文涛教授、鄂维南院士团队联合多机构推出大模型数据中心动态训练框架DataFlex。它是统一训练基础设施,纳入三类核心能力,解决底层系统问题,在效率和效果上有提升,受社区认可。

机器之心
新闻资讯7

传言:华为版 DeepSeek R2 本月发布

据 Huawei Central 报道,DeepSeek R2 可能本月 15 至 30 日发布,运行在华为 Ascend 910B 集群,硬件利用率 82%,算力 512 PetaFLOPS FP16,效率达 A100 的 91%,将 ChatGPT 5 竞争,但消息未证实。

AGI Hunt
新闻资讯8

AI鸿沟正在拉大!OpenAI报告揭示:不用AI的企业将被淘汰

12月8日OpenAI发布2025年报告,基于百万级企业客户数据,揭示企业AI使用量爆发式增长,重塑全球商业流组织架构。不同行业、地域加速渗透,同时企业和员工间AI鸿沟也在拉大。

AIGC开放社区
开源动态8

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏增强。

机器之心
开源动态8

35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源

5月15日上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率

GiantPandaLLM
算法论文8

多突触神经元模型问世,国内团队打造类脑计算新引擎,登上《自然·通讯》

当前人工智能高能耗问题凸显,脉冲神经网络被认为更具生物合理性、能效更高,但缺乏平衡计算效率和生物合理性的脉冲神经元模型。国防科技大学中科院团队合作提出 MSF 脉冲神经元模型,相关研究发表于《自然・通讯》。

机器之心
算法论文8

JFM | 浙江大学郑畅东、谢芳芳等:基于Transformer网络的上下文学习跨翼型的主动流动控制策略

浙江大学郑畅东、谢芳芳等提出基于Transformer网络的上下文学习跨翼型主动流动控制策略。该框架引入策略改进算子,结合强化学习气动形状优化,在翼型流动分离问题中表现出色,提升了整体性能。

力学与人工智能
产品应用8

构建知识闭环:用CodeBuddy打造自我进化的数据分析体系

腾讯团队为解决数据分析痛点,构建知识闭环体系,利用CodeBuddy设计开发规范、自动生成SQL,将编码从小时级降至分钟级。体系含沉淀、传递、生成、信赖、闭环五环,提升团队效率协作。

腾讯技术工程
算法论文8

强化学习远不是最优,CMU刚刚提出最大似然强化学习

CMU等机构研究指出,现实中广泛使用的强化学习未真正做最大似然优化,只是优化其一阶近似。基于此,团队提出最大似然强化学习,实验显示其在性能计算效率权衡上优于现有方法。

机器之心