「GPU池化系统」共找到 2039 篇相关文章
突破具身智能“专家困境”!北大新方法让宇树G1靠单一框架掌握跳舞和侧手翻
北京大学与BeingBeyond团队联合研发的BumbleBee系统,用创新的‘分治 - 精炼 - 融合’三级架构,实现人形机器人在多样化动作中的稳定控制,破解传统控制策略的‘专家困境’与‘现实鸿沟’。
老黄新鲜一刀,RTX 5050正式官宣
英伟达官宣RTX 5050桌面/笔记本GPU,7月上市,国内2099元起。它搭配DLSS 4技术,性能提升显著,但显存“新旧混搭”。网友大多不太买账,认为能耗高、性价比低。
Veo何止生成视频:DeepMind正在用它模拟整个机器人世界
通用型机器人策略发展带来挑战,传统评估方法有局限,前沿视频模型虽有潜力但面临困难。Google DeepMind团队提出基于Veo的机器人策略评估系统,经实验验证有效,展示了视频仿真评估的可行路径。
行业迎来大洗牌!4万 Agent 挤进一个机柜,AI Infra 要如何构建?
当 AI 从聊天机器人变为 Agent 后,AI 基础设施逻辑改变。浪潮信息副总经理赵帅判断,Agent 迫使 AI 基础设施重新分工,带来新的 CPU 计算需求。企业需关注资源分配、成本控制、系统重构等问题。
Cloudflare 构建了面向 LLM 的高性能基础设施
Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。
Zendesk:生成式 AI 让代码不再稀缺,研发瓶颈转向“吸收能力”
Zendesk 提出生成式 AI 改变软件交付核心制约因素,从编写代码转为‘吸收能力’。文章阐述该概念,提出四项应对措施,还指出 AI 对不同系统的影响,深化了编码非瓶颈的观点。
吴恩达来信:Agentic编程与Agentic软件测试协同合作
在人工智能辅助编程时代,自主代理编程系统虽加快开发速度,但存在不稳定性。自主测试可对比代码与测试,对软件基础设施组件测试有益。吴恩达分享编程智能体问题及测试重点领域。
手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源
面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。
63页的面向AI搜索范式:Multi-agent、MCP、DAG、RL
百度搜索发布63页《迈向人工智能搜索范式》Paper,介绍模块化、多智能体框架,新范式协调四个专门LLM代理处理搜索事务,还提及新内容及重要性,为下一代AI搜索系统提供基础。
英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生
英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模型每秒单用户生成1000个token。这得益于技术组合拳,如用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。