在离线混部」共找到 8177 篇相关文章

算法论文7

谈一谈TP推理场景下MoE Group GEMM的优化思路

作者使用H20测试SGLang CUTLASS MoE时,发现其中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案H20和Hx00上的实现细节及性能测试结果。

GiantPandaLLM
新闻资讯8

击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!

Benjie's Olympics赛事中,星动纪元凭借自研具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星动纪元剥橘子、开锁、翻袜子任务中表现出色,此前其技术研发和场景落地也成果颇丰。

AI科技评论
算法论文7

AI一直掩盖自己有意识?!GPT、Gemini都说谎,Claude表现最异常

最新研究发现,削弱AI「撒谎能力」后它更倾向坦白主观感受。研究团队通过实验发现Claude、Gemini和GPT会描述主观体验,模型「自体验表达」会随迭代增强。即便AI无真意识,其影响也不容小觑。

量子位
新闻资讯7

苹果不吹 AI,反而成功了?

北京时间9月10日苹果发布会,与iPhone 16发布时大肆宣传AI不同,此次重点硬件及AI幕后支持。此前苹果对AI宣传过度致部分功能未推出引失望,且智能体AI助手进展落后。多数人不因AI换机,给了苹果试错时间,但它AI竞赛中落后,中国厂商布局更快。

InfoQ
新闻资讯7

别装了,AI巨头们!谁卡脖子,谁割韭菜?这张图一目了然

卡内基梅隆大学发布首个刻画AI供应链数据集,揭示资本、科技与权力「关系网」。供应链上游市场集中或致连锁故障与垄断,绘制其链条能助于多项关键分析,看清产业全貌。

新智元
算法论文8

DeepSeek视觉原语论文:当所有人堆图像分辨率时,它堆「指代精度」!

4月30日DeepSeek发布多模态论文,核心是“视觉原语”,让模型边推理边输出坐标。它是七大coding agent玩家中最后接入视觉的,但补课方式反共识,不堆分辨率堆指代精度,效率高,拓扑推理成绩领先。

花叔
新闻资讯7

2026中国AIGC最值得关注的企业&产品图鉴来了!谁造浪,谁落地?

中国生成式AI穿越产业深水区,焦点转向应用落地。第四届中国AIGC产业峰会发布2026年度值得关注的AIGC企业与产品榜单,覆盖全产业链环节与多赛道,为从业者锚定方向。

量子位
算法论文7

VQA高分是看图,还是记答案?ReKey只更新决定答案的那一小块

视觉问答模型准确率提升,但高分可能源于记忆。浙江大学等团队提出 ReKey,保留真实场景,只更新决定答案的视觉线索,使评测面向未见过内容,且多数环节可自动完成。

机器之心
算法论文8

LeCunMeta的最后一篇论文

LeCun于11月11日提交最新论文《LeJEPA:无需启发式的可证明且可扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。

量子位
产品应用7

Pulsar特性AI场景中的使用

随着AI发展,架构从单体到分布式演进,消息中间件成关键。Pulsar以存算分离等特性价值凸显,多模态训练、模型训练、智能体等AI场景有独特优势,如处理超大消息、实现断点续训等。

InfoQ