GPU实现」共找到 2454 篇相关文章

产品应用8

昇腾+鲲鹏联手上大招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三大核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为大规模MoE模型训练扫清障碍。

新智元
算法论文8

大模型智能体如何突破规模化应用瓶颈,核心在于Agentic ROI

上海交通大学联合中科大研究指出,大模型智能体规模化应用有瓶颈,核心在于Agentic ROI 未达实用门槛。研究提出其发展呈「之字形」,先规模提升信息质量,再轻量化降成本。

机器之心
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心
产品应用8

字节扣子空间上新一键转播客功能,现在我们真成同事了|甲子光年

5月27日,字节跳动旗下AI协同办公平台扣子空间新增播客功能。其播客音频生成功能让AI从‘说什么’跨越到‘怎么说’,适用于多场景。扣子空间还具备跨模态协作等能力,引入MCP协议,免费开放核心功能。

甲子光年
新闻资讯7

Agent 元年,小厂碎步快跑反超

2025 年被视为 Agent 元年,AI 从“助手”走向“员工”。飞猪“问一问”出圈,虽小厂在模型、技术上不占优,但 AI Agent 落地门槛降低,小厂抓住场景和体验,或在 AI 时代弯道超车。

AI科技评论
新闻资讯7

OpenAI神秘项目曝光:cderGPT,用AI加速药物评估

OpenAI神秘项目cderGPT曝光,用于加速药物评估。FDA局长指出新药上市耗时长且未实现技术现代化,不过目前该项目细节未透露,有人支持用AI辅助审查,也有人担心其可靠性。

量子位
新闻资讯7

特斯拉为什么非要造Cybercab?|甲子光年

北京时间9月4日,特斯拉低调发布Cybercab,已进入奥斯汀Robotaxi运营体系。它专为Robotaxi打造,无方向盘与踏板。文章探讨特斯拉造它的原因,涉及成本、生产等,也指出业务面临财务和法规问题。

甲子光年
新闻资讯8

重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI

OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。

AI寒武纪
开源动态7

夯,还真的很不错,8.2k Star scroll-world,太丝滑~~~~

许多官网滚动特效不佳,scroll - world 让滚动驱动无切镜的品牌旅程。它通过生成镜头链、对齐接缝实现沉浸体验,还给出适用场景和接入方式,虽非零成本但复用了经验。

小华同学ai
推荐文章8

Agent的上限,可能不在模型,而在团队知识

文章记录安全中心团队搭建AI知识体系的实践,指出Agent输出质量取决于知识质量,分析传统知识库问题,介绍AI时代知识库转变、目标设定、搭建步骤、知识飞轮及避坑指南,还展示建设后的变化。

腾讯技术工程