上纬新材」共找到 5186 篇相关文章

新闻资讯8

华为,在黎明之前

2019年华为因‘实体清单’业务面临停摆,AI战略也被打乱。此后华为成立‘作战部队’攻克AI算力难题,2022年启动超节点研发,2025年发布CloudMatrix 384超节点,在多项指标超越英伟达。

芯师爷
开源动态8

W4A4KV4全量化框架,单卡A100大模型推理速度飙升

计算所王颖研究员团队等联合在ASPLOS 2025发表并开源COMET框架,通过系统 - 算法协同优化,实现全4比特推理性能突破,在多方面有技术亮点,实测性能碾压现有方案且已开源。

AIGC开放社区
新闻资讯8

刚刚,老黄官宣在中国台北建AI超算!

英伟达CEO黄仁勋在Computex 2025演讲官宣,将在中国台湾建首台世界级巨型AI超算及总部,还推出GB300等品,介绍NVLink Fusion等亮点,展望AI发展及通用机器人市场。

新智元
推荐文章8

北大校友,OpenAI前安全副总裁Lilian Weng最万字博客文章:Why We Think

北大校友Lilian Weng发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。

AI寒武纪
算法论文8

ICML 2025 | 如何在合成文本数据时避免模型崩溃?

随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心
开源动态7

字节开源DreamO,一个框架包揽多种图像定制需求

近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。

带你学AI
开源动态8

文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”

港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供范式。

量子位
新闻资讯7

1/8成本比肩Claude 3.7,Mistral Medium 3来了

“欧洲OpenAI”Mistral AI发布多模态模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已线,还推出企业聊天机器人服务,引发网友不同看法。

量子位
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
产品应用9

Jev 是个什么模型?它一个字都不生成,为什么还这么火?

本文深度解析TypeSafe AI发布的Jev模型,该模型不生成文本,专注提供高速结构化概率判断,分析了其架构、训练、适用场景,探讨了对AI行业格局的影响,给出开发者实用判断标准。

AI Reading Hub