「中国算力方案」共找到 2352 篇相关文章
DiT突遭怒喷,谢赛宁淡定回应
扩散模型核心基石DiT遭网友质疑,称其数学和形式有误,甚至怀疑无Transformer。作者谢赛宁回应抨击标题党,强调科学精神与实证方法,还肯定Tread,推荐Lightning DiT版。
时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8
在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。
DeepSeek-R1 更新,思考更深,推理更强
DeepSeek R1 模型完成小版本升级至 DeepSeek - R1 - 0528,用户可在官网、APP 等体验,API 同步更新。该版本强化深度思考能力,在多基准测评表现优异,还改善幻觉、提升创意写作等能力。
以加代乘?华为数学家出手,昇腾算子的高能设计与优化,性能提升30%!
大模型落地面临推理难题,华为团队基于昇腾算力发布三项硬件亲和算子技术研究,包括以加代乘的AMLA算子、融合算子技术、SMTurbo加速技术,实现能效、协同和速度突破,未来将拓展应用场景。
陶哲轩愤怒发文:AI正杀死数学百年开放传统!
本文报道OpenAI被指截胡纽约大学数学家破解纳维-斯托克斯方程的研究成果,菲尔兹奖得主陶哲轩发文怒批,指出AI暴力介入正在摧毁数学界百年开放科学传统,引发学界热议。
你的 AI 助理一闭嘴就在「发呆」?上交大 ProAct:把 Agent 的空闲时间变成生产力
上海交通大学 APEX 实验室提出 ProAct 架构,能把对话空闲时间转化为主动准备机会。它有预测、筛选、交付三级流水线,经 ProActEval 评测效果佳,证明算力用对地方更重要,让 Agent 能提前为用户准备。
1/10成本、Opus 4.7级表现,Cursor甩出了性价比之王Composer 2.5
Cursor推出新模型Composer 2.5,成本仅为Claude Opus 4.7的1/10,性能几乎追平。它更智能,擅长处理长时任务,遵循复杂指令更可靠。未来一周使用额度翻倍,还宣布与SpaceXAI合作训练新模型。
昔日GPU霸主,今日CPU屠夫?黄仁勋亮大招
2026年1月26日,英伟达CEO黄仁勋宣布以20亿美元购入CoreWeave的A类普通股。Vera CPU首次作为独立基础设施选项走向市场,挑战英特尔和AMD。其技术规格有巨大飞跃,能减少数据中心能耗与散热。
马斯克“开大”,600亿重金收购Cursor
SpaceX 宣布将以 600 亿美元收购代码生成初创公司 Cursor,或支付 100 亿美元合作。此前 xAI 编程项目落后,3 月挖角 Cursor 核心人员。Cursor 受竞争压力且缺算力,合作有望提升模型智能水平。交易或影响 SpaceX IPO 估值。
突发!奥特曼家被扔燃烧弹,OpenAI星际之门也出问题了
OpenAI掌门人Sam Altman住所遭燃烧弹袭击,他反思AI行业乱象,认为AI权力须民主化。同时,OpenAI核心项目星际之门经历人事震荡,战略转向依赖合作,海外英国项目因成本和监管搁置。