推理质量」共找到 2592 篇相关文章

算法论文7

SnapMoGen:44 小时动作数据 + 12 万文本注释,文本驱动动作生成数据集

近年来文本驱动动作生成有进展,但受限于数据集质量。Snap团队提出SnapMoGen数据集和MoMask++模型。前者有2万条动作片段和12.2万条文本描述,后者建模更有效,还结合LLM提升适用性,但二者都有局限。

带你学AI
新闻资讯7

3B小模型,编程得分比肩Opus 4.5,神秘模型引发热议,原是国产

最近,3B小模型VibeThinker - 3B在X上火了,它在编程等推理任务上比肩前沿大模型,体积却小很多。它是国产模型,来自新浪微博团队,在各项基准测试表现出色,不过在通用知识领域表现欠佳。

机器之心
新闻资讯8

中国AI芯片大突围,DeepSeek V3.1引爆算力革命

DeepSeek V3.1发布,是中国AI技术自主性的战略突围。它有6850亿参数,采用UE8M0 FP8适配国产芯片,具混合推理架构、Agent能力等。其发布或重塑AI产业格局,推动国产芯片发展。

AIGC开放社区
新闻资讯7

特斯拉OpenAI数据路线遇挫!8千平具身「兵工厂」+ego众包狂飙

2024年特斯拉和OpenAI在机器人数据采集上路线不同,前者重资产高精度,后者低成本众包。当前数据采集方式各有优劣,难以兼顾质量与成本。数据堂提出分层采集架构,通过场内工厂化和场外众包化双轮驱动解决难题。

新智元
算法论文8

华为超树HTP:不写示例、不调PDDL,AI规划约束通过率飙升62.6%

文章介绍华为超树HTP,它是完全自主、可泛化的推理新范式。能让LLM在超树结构上完成规划,不依赖人工示例和外部规划器,在复杂规划benchmark上实现SOTA准确率并降低token成本,还阐述其原理、创新点及应用实例。

CourseAI
开源动态8

冲上热搜!美团大模型,靠「快」火了

国内外开发者亲测,美团新开源的LongCat - Flash - Chat模型速度超快,推理速度超每秒100个token。它来自美团LongCat - Flash系列,官网可直接用。该模型架构创新,训练方法高效,还做了专属和系统级优化,跑起来又快又便宜。

机器之心
算法论文8

MSRA清北推出强化预训练!取代传统自监督,14B模型媲美32B

微软亚洲研究院联合清北提出全新预训练范式RPT,将强化学习融入预训练,把预训练语料库重构为推理问题集。实验显示RPT-14B表现出色,在多方面媲美甚至超越32B模型,未来RL或在LLM预训练掀起风暴。

量子位
新闻资讯7

MiniMax 技术闭门会分享:长上下文是 Agent 的 Game Changer

MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL能否赋予模型新能力、预训练价值等展开,指出长上下文是Agent的Game changer,混合架构将成主流,还分享了混合架构推理实践及M1相关问答。

Founder Park
推荐文章7

别再乱学AI了!我花7天实践了张Zara的方法,从此告别焦虑

作者实践张Zara的AI学习法后告别焦虑,分享学习-实践-链接-输出的心法。包括高质量输入,如看长视频、跟随创造者、深度用产品;内化输出,如公开学习、与创造者交流、实践;还提及启动和持续输出要点及优质信息源。

AI产品黄叔
算法论文8

CVPR2026满分论文:Proxy-GS为结构化3D高斯溅射引入统一遮挡先验

上海交通大学钟志航团队等在CVPR 2026提出Proxy - GS,面向基于MLP的结构化3D高斯溅射,用轻量级代理网格将遮挡关系变为可见性信号。在推理和训练阶段发挥作用,在遮挡密集场景实现渲染加速,画质与速度均优。

机器之心