硬件成本」共找到 1933 篇相关文章

产品应用8

Qwen3.8-Flash:全新架构,更强更稳更划算

本文介绍了 Qwen3.8-Flash 多模态 MoE 模型,它原生支持 262,144 token 上下文。该模型在 Attention、Residual、Embedding 与 Optimization 四个方面系统升级,降低训练与推理成本,即将上线千问 AI 平台。还发布了 Qwen3.8-Flash-Next 开源权重。

千问大模型
新闻资讯7

二十年老牌 IDE 栽在 AI 上?JetBrains 被差评逼疯批量删除评论,用户怒打 1 星抗议

JetBrains的AI助手插件下载超2200万次,但评分仅2.3分。用户不满其自动安装、速度慢、bug多等问题,负面评论被批量删除引发抗议。公司虽推出免费套餐和新AI智能体Junie,但仍面临成本、竞争等难题。

AI前线
新闻资讯7

华为统治折叠屏

今年折叠屏市场平淡,小折叠被放弃、大折叠更新佛系,因成本高、出货难。但华为逆势上扬,2025年推出四款机型,2026年上半年Pura X Max销量超50万台。折叠屏难打性价比,华为靠创新和品牌优势统治市场。

远川科技评论
产品应用8

一个月的活一周干完!英伟达世界模型训练速度飙升400%

英伟达世界动作模型 DreamZero 训练成本高、耗时长,无问芯穹与清华等推出的 RLinf 框架,从算子融合到 I/O 全链路系统级重构,使训练吞吐拉高近 4 倍,还解决多类性能瓶颈,保证训练效果。

新智元
产品应用8

1美元时薪?这才是打工人的「梦中情模」

Anthropic 的 Opus 4.6 好用但贵,MiniMax 推出 M2.5 与之抗衡。M2.5 在多方面表现卓越,参数量小,成本低,推理速度快,还经实测能成打工人得力助手,其背后有独特训练体系。

机器之心
产品应用8

面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成本降约75%。它结合稀疏与线性注意力,采用混合架构,继承权重降低成本,在长文本处理上优势明显。

AIGC开放社区
算法论文8

解决智能体手工构造难题! 浙大&腾讯提出 ReCreate,从零自动构建领域智能体

浙大、腾讯等机构研究者提出ReCreate框架,不依赖手工设计,让智能体自主构建。它从交互经验中找优化方向,有三重设计,实验显示能提升多领域任务通过率、降成本,未来或开启AI“自我制造”时代。

AI科技评论
新闻资讯7

为Token付费是一件很愚蠢的事情,用户应该为智能付费丨RockAI刘凡平@MEET2026

RockAI创始人刘凡平在量子位MEET2026大会提出,AI下一阶段要让模型“活起来”,实现硬件觉醒。他认为为Token付费愚蠢,应关注端侧智能,突破Transformer和反向传播算法,群体智能是迈向通用人工智能新路径。

量子位
开源动态8

英伟达一口气开源多项机器人技术,与迪士尼合作研发物理引擎也开源了

英伟达在机器人学习大会上发布多项开源技术,有Newton物理引擎、Isaac GR00T N1.6基础模型等,还在硬件层面下功夫。顶尖公司、高校已用其技术,全栈式布局或重定义机器人研发规则。

量子位
新闻资讯7

27亿美元天价回归!谷歌最贵「叛徒」、Transformer作者揭秘AGI下一步

在Hot Chips 2025上,Transformer发明者之一、谷歌Gemini联合负责人Noam Shazeer指出LLM发展需更多算力、内存等硬件支持。微软AI的CEO Mustafa Suleyman预测2026年底前LLM或成“行动型AI”,还提及失业潮等问题。

新智元