新模型Spud」共找到 9298 篇相关文章

产品应用8

比英伟达早,比李飞飞强,大晓Kairos原生一体化世界模型定义物理AI路线

大晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四大权威具身智能基准上全面登顶。

机器之心
产品应用7

jiSGLang集成ktransformers:2TB内存运行Kimi K2 Thinking模型

对于内存多但GPU资源有限的用户,SGLang集成ktransformers的CPU内核,支持直接运行Kimi K2 Thinking模型。它无需等量化,还能微调,虽性能与GPU方案有差距,但给用户选择。

AI工程化
算法论文8

拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型范式

使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。

机器之心
产品应用8

刚刚,AI音乐被重定义!昆仑天工甩出王炸,拿下全球第一

如今AI神曲传播快,AI音乐或帮助作品出圈。1月28日昆仑天工发布音乐大模型Mureka V8,模型降低创作门槛,提出AI音乐成音乐品类概念。实测其作品出色,技术上靠MusiCoT和人声建模加持。

机器之心
算法论文8

正交化之外是什么?微软等提出ARO优化器:训练提速1/3,揭示矩阵优化「蓝海」

微软研究院联合多校发布论文,提出优化器 ARO。它将梯度旋转作为原则,能让大模型训练提速约 1/3,比 Muon 高效 10% - 15%,还能全模型优化,揭示了矩阵优化方向。

机器之心
算法论文8

用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态框架

华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务上达SOTA。

量子位
算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心
产品应用7

DeepSeek识图模式是个模型?!一手实测在此(没错我被灰度到了)

作者喜提DeepSeek识图模式灰度测试,实测发现其非思考模式速度快,推理有幻觉;思考模式推理慢且冗长。实用功能如OCR、复原HTML较靠谱,但色盲测试偶翻车。该模式或用独立视觉模型,且多模态进展超预期。

量子位
开源动态7

这张信息图,居然是8B开源模型做的??

商汤开源的 8B 多模态模型 SenseNova U1,架构独特,图像评测表现好,信息图生成能力强、延迟低。它具备图文交错能力,适合自媒体、敏感行业等,有在线体验和开源代码入口。

花叔
产品应用8

1人顶1个Infra团队!OpenAI前CTO招,让大模型训练跌成白菜价

模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。

新智元