多GPU性能」共找到 5727 篇相关文章

开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸优势。

机器之心
开源动态8

Andrej Karpathy 盛赞!斯坦福团队新作,让Llama-1B 实现毫秒级推理

斯坦福Hazy Research团队将开源模型Llama - 3.2 - 1B前向推理整合为“Megakernel”,把推理延迟大幅降低,显存带宽利用率显著提升。团队指出当前主流LLM推理系统在小batch、极低延迟场景下低效,提出Megakernel以重构执行方式。

AI科技评论
新闻资讯7

21 页 PDF 实锤 Grok 3“套壳”Claude?Grok 3 玩自曝,xAI工程师被喷无能!

网友 GpsTracker 爆料,xAI 公司的 Grok 3 在“思考模式”下自称是 Anthropic 公司的 Claude 3.5。种模式测试显示异常回应仅在“思考模式”触发,21 页 PDF 记录也证实其“自曝”。此事引发热议,有人吐槽预训练团队水平差。

AI前线
新闻资讯7

最新!OpenAI:GPT-5将实现大统一,Codex最佳实践是这样的

OpenAI Codex在Reddit AMA活动中,核心负责人围绕先推云端代理、GPT - 5与Operator整合等问题给出路线图。如Codex - 1预览情况、CLI设计、使用场景、安全模型、接入计费及API生态等方面都有说明。

AI寒武纪
新闻资讯7

OpenAI官方发布【Codex 上手指南】

OpenAI 昨晚推出 Codex 研究预览版,这是强大的远程编码智能体,能导航代码库、解答疑问等。官方还发布使用指南视频,介绍了快速上手步骤、工作方式,以及提升效能的方法。

AI寒武纪
产品应用8

登顶 Arena!MiniMax 最新 Speech-02 模型屠榜:超越OpenAI、ElevenLabs,人声相似度99%

近期TTS模型领域发展火热,众机构纷纷发力。MiniMax推出的Speech - 02模型登顶Arena榜单,在字错率和相似度等指标上表现出色,具备超拟人、个性化、样性特点,性价比高,还创新架构解决了现有痛点。

AI前线
新闻资讯8

重磅!Google 推出AlphaEvolve 实现算法自我进化,将颠覆数学与计算机科学!

Google DeepMind发布革命性的Gemini驱动编码代理AlphaEvolve,能设计并优化算法。它发现更快矩阵乘法算法、解决开放性数学问题,还优化了Google方面计算基础架构,未来跨领域应用前景广。

AGI Hunt
算法论文8

RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力

模态奖励模型对提升模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。

机器之心
产品应用8

微软将大量AI功能、智能体集成在Windows11,全民AI时代来了

今天凌晨微软官网发布以AI为主题的新版Windows 11,集成诸AI功能,如设置中的Agent、Click to Do等,还推出两款新Copilot+PC设备,目前仅支持英文,未来会扩大范围。

AIGC开放社区
新闻资讯8

刚刚,OpenAI宣布内部模型批量攻破100道数学难题,普林斯顿高研院正式介入

本文报道OpenAI最新AI进展,其内部新模型批量攻破100道长期悬而未决的公开数学难题,联合普林斯顿高等研究院成立独立学术顾问小组规范成果评估,引发数学界震动。

AI寒武纪