「超节点架构」共找到 3819 篇相关文章
百芯竞逐,芯片产业的“新战国时代”
ASIC发展超预期,成AI竞争胜负手。它适配大厂专属需求,成本与功耗低,出货量和市场规模将扩容。英伟达GPU虽难替代,但份额会被ASIC蚕食,谷歌TPU已撕开其垄断裂缝,大厂纷纷自研ASIC。
大事不好!机器人学会预测未来了
蚂蚁灵波连续四天开源,此次推出全球首个用于通用机器人控制的因果视频 - 动作世界模型LingBot - VA。它能脑补未来,有记忆不丢失、高效泛化等亮点,架构设计独特,实验效果出色,推动通用机器人走向视频时代。
曦望,死磕AI推理成本|甲子光年
1月27日,国产GPU厂商曦望发布新一代推理GPU芯片启望S3等。启望S3面向大模型推理定制,设计系统级重构,单位Token推理成本降约90%。曦望还推出超节点方案及推理云计划,目标是极致推理性价比。
763亿港元,大模型公司最大规模IPO!MiniMax登陆港交所,开盘前大涨50%
MiniMax正式在港交所主板挂牌上市,股票代码“00100”。此次全球发售约3358万股,募资约55.4亿港元。市场认购热烈,早盘一度涨幅超50%,市值突破763亿港元。其技术多模态齐发,组织高效,为行业提供新样本。
Nature Computational Science | 香港城市大学韦业等:复杂系统深度主动优化
本文通过集成深度神经网络和树探索能力,提出神经网络代理模型引导树探索的主动优化方法。该方法在超2000维数值优化问题中找到全局最优,在多领域表现优于现有方法,为小样本、高维优化难题提供通用技术。
极简RL新范式:一半算力刷新1.5B模型推理SOTA
过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。
2.4万亿参数原生全模态,文心5.0一手实测来了
文心5.0正式发布,主打原生全模态,支持全模态输入和输出。官方测试显示其多维度表现突出,在LMArena文本排行榜并列全球第二。实测其理解精细、能捕捉细节,技术上采用自回归统一结构和超大规模混合专家架构。
Agnes:不做通用型智能体丨对话全民AI应用平台Agnes AI
量子位智库对话Agnes AI创始人Bruce Yang,探讨多智能体在AI产品的应用。Agnes AI以Multi Agent架构为核心,上线四月日活破20万。其介绍了核心功能、单多智能体差异、评估维度等,还谈及目标人群、市场规模等内容。
焦虑的贝索斯,决定先裁30000人
亚马逊启动史上最大裁员,先裁14000人,明年或再裁。表面因疫情后人员冗余,实则源于AI军备竞赛压力,AWS优势缩小。公司还计划用机器人替代超50万员工,中层和初级岗位受冲击大,H - 1B员工处境艰难。
LeCun怒揭机器人最大骗局,坦白Llama与我无瓜!
Meta首席AI科学家LeCun在MIT演讲称,机器人行业离通用智能还远,家用机器人需AI突破,核心是打造‘世界模型’架构。此观点引特斯拉、Figure高管回怼。他还表示LLM有本质瓶颈,世界模型将成未来AI主流。