「硬件瓶颈」共找到 1029 篇相关文章
架构彻底重构!DeepSeek新模型代码曝光,要来的V4让国内外都坐不住了?
DeepSeek官方GitHub代码库曝光代号“MODEL1”新模型线索,或为V4内部代号。代码显示其有重大架构变更,能并行处理稀疏与稠密计算,适配英伟达新架构。此前R1发布推动中国AI开源生态发展,新模型备受期待。
黑森林FLUX.2 Klein开源,亚秒级高质量图像生成和编辑,普通电脑就能跑
黑森林实验室发布开源的FLUX.2 Klein模型家族,是紧凑架构,将高质量图像生成与编辑速度压缩至亚秒级,在消费级显卡实现旗舰性能。其统一架构打破生成与编辑壁垒,还与NVIDIA合作优化。
上市后的摩尔线程,重心从造芯变成建生态
上市刚满15天的摩尔线程在MDC 2025大会展示全栈技术成果,回应市场关注。其创始人强调生态是GPU行业核心,正构建MUSA生态体系,MUSA架构升级,还揭晓‘花港’架构及两款芯片技术路线。
Agent 正在终结云计算“流水线”,Infra 必须学会“思考” | 专访无问芯穹夏立雪
InfoQ 专访无问芯穹联合创始人夏立雪,他分享了面向 Agent 的基础设施建设进展与经验,探讨从“处理”到“思考”的范式转变对基础设施的冲击,指出 Agent 规模化落地阻碍及解决办法,还谈及 Agentic Infra 等内容。
Nature公开谷歌IMO金牌模型技术细节!核心团队仅10人,一年给AI编出8000万道数学题训练
谷歌DeepMind的IMO金牌模型AlphaProof技术细节公开。团队规模小,核心成员是IMO金牌得主。它把数学证明当游戏,用30亿参数模型和改进树搜索算法。训练难题靠自动形式化解决,赛场用TTRL突破,已开放使用。
扩展外部测试时Scaling Law,中关村学院新发现:轻量级验证器可解锁LLM推理最优选择
文章聚焦大语言模型‘测试时扩展’,指出内部方法接近瓶颈,外部方法的传统实现有缺陷。提出 TrajSelector 策略,用轻量级打分模型复用隐状态打分,训练无需手动标注,实验显示性能增长稳定。
Jina官方MCP三板斧:搜、读、筛
Jina官方发布MCP服务器,将核心能力封装成LLM工具集。介绍工具功能、连接使用方法,给出问题排查方案,通过案例展示搭建工作流效果,评估不同模型,指出Agent瓶颈及MCP开放生态价值。
Granola 为什么能赢:会议笔记,把产品做简单很重要
Granola是新推出一年多的AI笔记产品,迅速成硅谷创业者、投资人常用工具。其创始人认为,“AI笔记”头号竞争对手是苹果备忘录。产品好用关键在于极简“蜥蜴脑设计”与利用用户“上下文”,文中还分享设计思考与实用经验。
2.1K Star 本地实时数字人!阿里开源低延迟数字人系统,2.2秒实时响应!
阿里在GitHub开源轻量本地实时数字人对话系统OpenAvatarChat,摆脱高性能硬件依赖等问题。它平均回答延迟2.2秒,有100+预置形象,支持多模态交互,提供多种部署方式,适配多场景。
为什么GPT-5算得出微积分,却数不清积木?
文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等方面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。