FP4训练」共找到 3427 篇相关文章

新闻资讯8

马斯克用恐怖算力,堆出6万亿参数性能怪兽Grok 5!剑指AGI

马斯克以Grok为核心推进xAI,从算力、数据到产品生态全面布局通往AGI的道路。Grok迭代迅速,有独特研发哲学。X平台数据、特斯拉算力成资源护城河,Grok还将进入特斯拉汽车。但Grok成长中也有争议,xAI在探索中前行。

新智元
新闻资讯7

内存涨价赛过黄金,这些存储公司业绩、股价两开花

近期存储价格年内持续飙涨,幅度超黄金。DDR4现货价较年初暴涨200%,部分经销商溢价出售。存储产品涨价源于AI应用扩张,供不应求热潮蔓延至封测端。多家存储公司业绩和股价两开花。

芯师爷
算法论文8

让AI生成视频「又长又快」:Rolling Forcing实现分钟级实时生成

南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时长视频生成瓶颈,实现分钟级实时生成,还支持交互控制,但仍有优化方向。

机器之心
算法论文8

更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画

香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。

AIGC开放社区
新闻资讯7

Cursor“自研”模型套壳国产开源?网友:毕竟好用又便宜

美国顶流AI产品Cursor和Windsurf发布新模型,被指“套壳”中国开源大模型。Cursor新模型干活时说中文,Windsurf或用智谱GLM。中国开源模型物美价廉,在榜单和下载量上表现出色。

量子位
算法论文8

别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案

团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。

深度学习自然语言处理
开源动态8

大模型优秀大脑齐聚硬核开源聚会,SGLang社区举办国内首次Meetup

10月25日,SGLang联合美团、亚马逊云科技在北京举办国内首场Meetup。SGLang是开源高性能推理引擎,特性丰富。活动中大咖和开发者分享见解、进展、应用场景,展现其社区活力与发展潜能。

机器之心
开源动态8

SIGGRAPH Asia 2025|电影级运镜一键克隆!港中文&快手可灵团队发布CamCloneMaster

香港中文大学与快手可灵团队联合提出运镜可控视频生成框架CamCloneMaster,引入‘参考即用’范式,告别对相机参数依赖。其训练、测试代码和数据集均已开源,在各项指标上优于SOTA方法。

机器之心
新闻资讯7

前Meta大神创业,用强化学习打造PokeeResearch-7B模型,刷新AI深度研究SOTA

Pokee AI发论文介绍70亿参数的PokeeResearch - 7B模型,用基于AI反馈的强化学习和推理框架,在深度研究基准测试中成绩领先。该公司由前Meta大神创立,产品可打通多应用,已获融资并公开测试。

AIGC开放社区
算法论文8

一篇92页大模型Vibe Coding技术全面综述

中科院计算所&杜克大学发布首篇Vide Coding技术全面综述。介绍以“氛围/结果”为导向的Vibe Coding开发范式,含技术分类、能力分析、开发模式、数据模型等内容,还提及价值及反馈回路等。

PaperAgent