「Claude新模型」共找到 10187 篇相关文章

产品应用8

昇腾+鲲鹏联手上大招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三大核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为大规模MoE模型训练扫清障碍。

新智元
推荐文章8

北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think

北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。

AI寒武纪
算法论文8

AI「看不懂」、「做不好」视频的问题,混元用「MTSS」解决了

腾讯混元团队提出 Multi-Stream Scene Script(MTSS)新视频描述范式,将传统方式升级为‘多流结构化剧本’。它解决了传统方式语义冗余、扩展性差等问题,在视频理解和生成任务表现显著。

机器之心
开源动态8

LeRobot v0.5.0 正式发布

LeRobot v0.5.0正式发布,是规模最大的一次发布。在硬件上支持更多机器人,策略模型新增6种,数据集处理优化,还推出EnvHub,代码库也全面升级,此外社区与生态建设也有进展。

Hugging Face
开源动态8

开源共建重塑推理 Infra:从架构创新到生态协同,Mooncake的破局之路

大模型推理落地面临成本、吞吐、长上下文“三角困境”。开源项目Mooncake以“计算存储解耦”为核心,通过PD分离等技术提供底层支撑。直播邀请专家从多视角拆解其技术逻辑、开源价值与企业实践。

InfoQ
算法论文8

清华挖出「幻觉」的罪魁祸首:预训练产生的0.1%神经元

清华大学孙茂松团队从神经元角度研究LLM幻觉微观机制,发现不到0.1%的H - 神经元可预测幻觉,与过度顺从行为相关,根源在预训练阶段,为解决幻觉问题、开发可靠大模型提供新思路。

新智元
新闻资讯7

AI产业正在围着OpenAI和Anthropic两家公司打转

过去半月AI行业看似平静,实则产业结构正密集重组。OpenAI、Anthropic成算力黑洞,众多公司围绕其开展业务。同时,AI落地服务成新赛道,自研芯片潮兴起,产业分工不稳定。

DeepTech深科技
开源动态8

一天斩获2.5k星星!首个可以「让AI直接画CAD」的开源项目来了

新开源项目text - to - cad很猛,只需把需求告诉AI,它就能生成可编辑3D模型、导出文件,还能预检。支持多格式,有几何引用等特点,一天获2.5k星。

开源AI项目落地
开源动态8

智谱 GLM-4.7,Coding 开源第一,其他也很强

智谱正式发布并开源专为 Agentic Coding 打造的 GLM-4.7 模型,编程、推理、Agent 能力成绩亮眼,价格比 Claude Sonnet 4.5 更优。还推出 Coding Plan 套餐,使用方式多样。发布前几天,智谱港股招股书挂网。

AGI Hunt
开源动态8

ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态

滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑的多模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个多模态任务,在多项基准超现有方法,代码已开源。

机器之心