超节点架构」共找到 3785 篇相关文章

算法论文8

无需再训练即可增强性能!港大团队提出GPC框架,实现机器人「策略组合」

在机器人学习领域,提升策略性能常需巨额成本。香港大学团队提出GPC框架,通过“策略组合”创造越单一父策略的“组合策略”,免训练且跨架构、模态融合,经仿真和真机实验验证性能提升。

机器之心
算法论文8

除了prompting外,不动参数,如何改变模型行为?

文章指出传统提示工程控制大模型生成行为有缺陷,提出Steering Target Atoms (STA)方法。它用稀疏自编码器分解LLM高维表示,定位“原子知识组件”精准控行为,实验效果现有技术,还能控制推理长度。

深度学习自然语言处理
新闻资讯8

HBM Roadmap和HBM4的关键特性

文章介绍 KAIST TERALAB 公布的 HBM 技术,涵盖 HBM 路线图和 HBM4 特性。HBM 路线图展示从容量升级到计算存储融合的进化,HBM4 在电气规格、封装冷却、架构等方面有突破,AI 工具也用于研发。

芯师爷
新闻资讯8

苏妈联手OpenAI,AMD发布3nm怪兽MI355X,性能碾压英伟达B200!

AI芯片战争白热化,AMD在大会发布3nm工艺的MI355X,推理性能英伟达B200,还公布明年推出的MI400系列等新品。OpenAI CEO称将用AMD芯片,AMD与OpenAI开启合作。

新智元
新闻资讯8

全球首个「百万引用」学者诞生!Bengio封神,辛顿、何恺明紧跟

Yoshua Bengio成谷歌学术首个论文引用百万的人,Geoffrey Hinton达97万次。全球高被引TOP 10中,计算机领域占4席,均属AI领域。深度学习论文引用爆发,契合AI时代。还介绍了Bengio、何恺明等AI领域高被引作者情况。

新智元
新闻资讯7

骂战半年、站队失效,具身智能公司集体换了“新剧本”,VLA“自救”成功了吗?

2026年具身智能赛道经历‘技术路线大分流’,VLA遭质疑,‘世界模型’和VA路线兴起。具身智能进入‘落地祛魅’阶段,厂商开始‘路线混搭’,VLA和世界模型都在进化,行业探索新架构,具身智能无完整技术路线图。

InfoQ
产品应用7

全球首个完全AI编写的训练框架来了,速度反英伟达:面壁要用 AI 把国产算力软件重写一遍

面壁智能发布全球首个全由AI编写的训练框架ForgeTrain,在华为昇腾系列上验证,速度英伟达Megatron 10%。其构建分三阶段,目标是为不同需求“现场锻造”软件,还为国产算力软件生态赶提供新思路。

AI前线
开源动态7

小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek

小米开源 MiMo-V2.5 和 MiMo-V2.5-Pro 两款模型,采用 MIT 协议,适合商业应用。在基准测试中表现出色,有竞争力价格和限时优惠。但与 DeepSeek 比,架构创新偏工程化,也有推理表现不足等问题。

AI前线
开源动态8

英伟达龙虾模型开源,12B激活登上成功率全球第四

英伟达发布专为龙虾打造的开源模型Nemotron 3 Super,总参数120B,激活参数12B,在龙虾模型基准PinchBench上成功率全球第四。该模型结合Mamba与Transformer架构,引入多项创新技术,还开源了模型权重、数据集等。

AIGC开放社区
推荐文章8

全球爆红后,Clawdbot之父2小时深度专访:退休3年后我杀回江湖

新智元对Clawdbot之父Peter Steinberger进行近2小时专访。他分享AI编程工作流,如一天600个Commit、让AI验证代码、用多个Agent并行开发。他还讲述经历,认为AI时代程序员要关注系统架构,强调与AI融合。

新智元