人在循环中」共找到 8903 篇相关文章

开源动态8

智谱终于发布GLM-4.5技术报告,从预训练到后训练,细节大公开

上个月底智谱开源 GLM-4.5 及轻量版,成绩亮眼引热议。现其技术报告发布,详述预训练到后训练细节,还介绍了开源 RL 框架 slime,展示模型架构、训练阶段等,评估了多任务上的表现。

机器之心
新闻资讯8

甲小姐对话彭志辉:既然选择做公众物,就必须接受被期待的代价 | 甲子光年

甲子光年的甲小姐对话智元机器联合创始彭志辉,他称公司是具身行业估值“撑伞”,采用全栈自研战略。双方还探讨融资、战略、市场、技术、商业、组织等话题,他分享公司发展现状、前景及应对策略。

甲子光年
新闻资讯8

谢赛宁开炮,现场打脸CVPR评审!Sora开山之作DiT被拒,怒斥AI学术圈畸形

CVPR 2025上获年轻研究者奖的谢赛宁批判AI学术界畸形,回顾DiT、SiT论文被拒却成Sora等奠基成果的经历。他借“无限游戏”与“有限游戏”概念谈AI研究,指出应坚持“无限游戏”,打破当前困境。

新智元
开源动态7

GPU-MODE Leaderboards之vector_add histogram 以及一些有趣发现

文章介绍GPU-MODE Leaderboards中vector_add和histogram任务。分析vector_add实现、带宽利用率,rank1代码用cccl,带宽利用率超80%;histogram算子瓶颈atomic冲突等,rank1也多用cccl,还给出rank2代码,最后提及任务中Hack行为及代码提交方式。

GiantPandaLLM
新闻资讯7

全网爆火的DeepSeek「UE8M0 FP8」,原来英伟达早已支持

NVIDIA PTX ISA文档早有.ue8m0数据类型,UE8M0 fp8并非DeepSeek独创。从PTX 8.0/9.0起,NVIDIAISA级别支持.ue8m0,H100、RTX 40系列等都有相关支持,DeepSeek是将其提升到模型层面。

AI寒武纪
产品应用8

杀疯了!单卡4090跑通全量微调,面壁1B级多模态性能怪兽硬刚大厂

面壁智能推出MiniCPM-V 4.6,参数约1B,性能和推理效率出色。它多模态任务综合能力、推理速度上领先竞品,靠ViT架构改造和4倍/16倍混合视觉Token压缩实现创新,有工业验证,对开发者和普通用户意义大。

AI寒武纪
算法论文8

离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器训练范式

杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,形机器上有新突破。

量子位
开源动态8

最强开源机器大脑!蚂蚁两万小时真机数据开启物理AI缩放定律

蚂蚁集团开源具身智能基座模型LingBot-VLA,用两万小时真机数据证明机器学习有缩放定律且未达瓶颈。该模型优势显著,多平台表现出色,团队还从数据、架构、工程等方面进行优化,并开源代码等加速行业探索。

AIGC开放社区
新闻资讯7

小米小爱同学:资源受限下,实现端侧大模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责杨永杰,了解其团队资源受限的端侧设备实现大模型高性能推理的策略。目前端侧大模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
推荐文章7

“光靠盯不住了”!拆解上万张晶圆,这家公司靠AI将芯片良率提升数个百分点

喆塔科技创始赵文政称国内跑通AI的半导体工厂少,工业AI尚处发展阶段。喆塔将DeepSeek接入自研大模型,提升训练效率。还分享了团队实例,强调工业AI决胜点行业知识。此外,介绍了喆塔切入AI领域的过程、应用成果、面临挑战及未来策略等。

AI前线