高性能框架」共找到 4571 篇相关文章

产品应用7

748GB内存、20P算力,英伟达把数据中心塞进了桌子底下,第一台已经送到Karpathy家里

英伟达DGX Station GB300首批系统交付开发者,首台给了Andrej Karpathy。它有748GB内存、20P算力,用GB300芯片架构。背后是长时运行自主智能体开发需本地算力,英伟达从软硬层面推进。

AI寒武纪
算法论文8

正交化之外是什么?微软等提出ARO优化器:训练提速1/3,揭示矩阵优化新「蓝海」

微软研究院联合多校发布论文,提出新优化器 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 效 10% - 15%,还能全模型优化,揭示了矩阵优化新方向。

机器之心
产品应用8

准确率提升至 90%,阿里商旅基于 AgentScope 构建多智能体差旅助手最佳实践

阿里商旅依托阿里巴巴生态,旗下AliGo差旅助手可实现业务闭环。早期单智能体模式有瓶颈,后基于AgentScope构建多智能体系统,从技术选型、架构设计等多方面优化,事项收集准确率提至90%+,还解决诸多问题并获奖。

阿里云开发者
新闻资讯8

一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布

模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。

量子位
开源动态7

不写、不看、不审查:这家安全公司决定不再让人类碰代码,还把这套模式开源了

2026年2月,安全公司StrongDM公开“软件黑灯工厂”式生产线成果,人类不直接写代码和审查,由Agent自动生成。该模式开源,虽有开发者指出问题,但获学界认可,不过面临成本的现实问题。

InfoQ
新闻资讯7

黄晓明开心麻花助演!智元机器人春晚太会整活了

智元机器人办了场“春晚”,让机器人当主演,还有黄晓明和开心麻花助演。节目形式多样,实现从“机器人演节目”到“机器人撑起一整台晚会”的质变。此外,今年还有宇树、魔法原子等四家官宣上春晚。

量子位
算法论文8

登顶Hugging Face论文热榜,LLM重写数据准备的游戏规则

企业数据团队面临数据准备难题,传统方法依赖人工规则,有诸多局限。上海交通大学等机构研究团队综述指出,LLM正推动数据准备从“规则驱动”向“语义驱动”转变,还给出技术选型、评估基准及工程指南。

机器之心
产品应用8

美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局

近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出后续探索方向。

机器之心
新闻资讯7

老黄大出血!OpenAI背刺英伟达,微软自研芯连夜拆掉CUDA护城河?

2026年1月26日微软官宣第二代自研AI芯片Maia 200上线,还推出软件Triton。它塞满SRAM,推理成本更低、效率更。这让英伟达面临生存危机,AI算力圈也变天,降本成关键。

新智元
新闻资讯7

Docker 通过 Cagent 提供 AI 代理确定性测试

AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。

InfoQ