「新闻类播客」共找到 3807 篇相关文章
从一行代码发现DeepSeek的秘密:Model1到底是什么?
在DeepSeek - R1发布一周年时,有人在GitHub的FlashMLA代码仓库发现神秘代号Model1,可能是V4。文章分析了代码仓库用途、新模型“露馅”原因,还从代码中发现Model1细节,结合论文梳理时间线,最后也提出了怀疑。
【CUDA 博客】TMA简介 & 让矩阵转置在Hopper GPUs上变得更快
文章介绍Hopper GPU新特性TMA,它能高效传输多维数组数据。文中展示用TMA对2D数组操作,如创建张量映射、编写kernel等。还讲了避免共享内存bank冲突的交织方法,最后介绍在Hopper GPU上实现高效矩阵转置的多种方式及性能。
xAI员工赢麻了!全员换股SpaceX,AI月烧10亿美元终于有人兜底了
今天凌晨,计划今年 IPO 的 SpaceX 收购 xAI,全股票交易,新公司估值 1.25 万亿美元。马斯克阐明“太空 AI 算力”路线,认为未来两到三年,AI 计算成本最低的地方会在太空,但面临诸多问题。此次合并或是为 IPO 铺路。
奥特曼首曝GPT-6,亲口承认GPT-5「搞砸了」!接入大脑读心,估值或飙破5000亿
奥特曼在旧金山采访中透露GPT-6相关信息,坦言GPT-5发布‘搞砸了’,GPT-6主打个性化记忆功能。OpenAI新一轮融资后估值或达5000亿美金,但投入算力成本高,其估值也存泡沫争议。
实测LibTV团队版:AI视频的工作室时代来了!
作者实测LibTV团队版,分享用其制作皮克斯风格3D动画片段的过程,介绍团队版核心功能,如团队主体库、共享积分池、权限管理等,还提及新功能,指出AI视频走向工业化,而该团队版是首个专注团队协作的工具。
美国模型长期霸榜的LMArena,出现了一个国产模型
2025 年底,中美 AI 阵营发展路径有区分,美国多是强模型加工具链,中国在多方面发力。12 月 23 日 LMArena 更新文本榜,百度文心新模型 ERNIE - 5.0 - Preview - 1203 以 1451 分登上榜单,成中国第一且是前 20 名里唯一非美国模型。
存储的超级周期,缺货潮将贯穿2026年?
近期存储市场火热,价格飞涨,下游厂商面临成本压力。缺货潮或贯穿2026年,因AI需求爆发,三大厂商减产DDR4等产能。其他厂商难补缺口,华邦虽有扩产计划但周期长。端侧AI发展对存储有新要求,华邦布局相关产品。
Meta华人天才毕树超「叛逃」预言:OpenAI未竟交互革命,暗藏万亿赛道
Meta科学家毕树超在演讲中揭秘AI进化真突破,认为更好更快造数据是关键。他指出AI原生交互领域若有新突破,或催生万亿级公司,语音和视觉将成重要部分,还分享了AI进化时间线及面临的问题和未来图景。
对话王小川:换个身位,做一家「医疗突出」的模型公司
百川智能创始人王小川与极客公园创始人张鹏长谈。百川曾快速扩张后调整,聚焦医疗。其新发布的医疗大模型Baichuan - M2性能优异,超OpenAI两开源模型。王小川认为造AI医生复杂,且AI家庭医生会比无人驾驶更早到来。
从 Langchain 到 Spring AI,我们究竟需要怎么样一个企业级 AI 开发基础设施?
文章指出AI Agent应用开发方式演变快,企业构建AI Agent体系面临挑战。介绍了AI Agent应用架构变化及趋势,如AI应用平台低代码效应、框架与平台双轨并行等,还总结了四类AI Agent框架及企业级框架平台核心考量。