「成本性能」共找到 6987 篇相关文章

产品应用8

训练MoE足足提速70%!华为只用了3招

Scaling Law下,MoE成扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载不均等问题,使训练吞吐提升72.6%。

量子位
算法论文8

1/15成本,实现AI水印新SOTA | 南洋理工大学&A*STAR

给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
开源动态8

一张图片+ 一条音频,照片开口说话唱歌,多角色、情绪控制都拿捏了。

腾讯混元联合腾讯音乐推出 HunyuanVideo - Avatar 模型,上传照片配音频就能生成动态视频。支持多风格角色、情绪控制和多角色对话,单角色模式已开源,技术有创新,在多数据集表现优。

AI进修生
产品应用7

物理引擎 + 视频生成!输入一张图,让AI演给你看真实物理世界

WonderPlay将物理仿真与视频生成结合,从单张图像生成动态3D场景。它引入混合生成模拟器,形成物理求解器与视频生成器闭环。与其他方法对比,WonderPlay在多种场景和材质下表现更优。

带你学AI
新闻资讯7

claude 4摔碎了码农的饭碗~

昨晚Anthropic发布Claude 4系列模型,Opus 4编码能力强,SWE - bench测试成绩优,能完成7小时代码重构。Claude 4让完成日级任务的时间提前,各应用纷纷接入,部分产品有应对策略。

探索AGI
产品应用8

谷歌Gemini Diffusion:1500 token/秒,快如闪电!

谷歌DeepMind在I/O 2025上推出实验性模型Gemini Diffusion,将扩散技术用于文本生成。它每秒能生成约1500个token,比Gemini 2.0 Flash - Lite快5倍,具备高响应速度、文本连贯性等优势。

AGI Hunt
算法论文8

ICML 2025 | 无需训练,即时对齐大模型偏好

上海人工智能实验室提出TPO方案,可让大模型在推理时快速对齐人类偏好,无需更新模型权重。TPO类似文本形式的梯度下降,在多个基准数据集评测中表现出色,还提供“宽深结合”推理拓展策略。

深度学习自然语言处理
算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
推荐文章8

Claude: 追问

文章围绕「追问」展开探讨,指出追问能发现思考破绽,有苏格拉底式、维特根斯坦式等方法。追问之道在于揭示存在遮蔽,有陌生化、边界游走、敞开等待三种方法,还提及诗歌留白是纯粹追问形式。

李继刚
新闻资讯7

AI杀死大学?教授ChatGPT教学逼疯学生,怒告学校讨要8000美元学费!

美国东北大学一名学生发现教授用ChatGPT生成课件,愤而起诉学校讨要8000美元学费。学生认为付高价学费应接受人类教导;教授则称AI可节省时间、充当助教。不同教授对AI使用看法不一,领英联合创始人看好AI在教育的应用。

新智元