大模型开源」共找到 10086 篇相关文章

算法论文8

告别数据「噪音」,UCSD模型推理新方法DreamPRM充当「信号放器」,登顶MathVista测评榜

DreamPRM由加州学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态模型集成,提升推理能力,实验效果显著。

机器之心
8

李曼玲、李飞飞、吴佳俊等联手:评估具身模型的新范式!

全新的具身模型空间能力评估范式Theory of Space突破传统局限,考察模型在动态环境构建、修正和利用空间信念的能力。该论文被ICLR 2026接收,研究对前沿多模态模型评测,揭示其空间认知能力边界。

新智元
推荐文章7

端侧跑模型,现在也太简单了

作者Vicki Boykis分享本地运行AI模型体验,指出如今本地模型性能提升,像GPT - OSS、Gemma 4系列表现出色。还介绍运行本地智能体流程的设置,虽有问题,但优势多,生态值得投资。

机器之心
产品应用8

如何破解海量内容审核难题?快手安全模型技术探索与应用实践

在数字内容爆炸式增长下,传统内容审核模式难应对挑战。快手安全算法中心负责人刘梦怡分享自研多模态模型技术方案与应用实践,涵盖架构、数据、训练等,还介绍审核智能化应用及未来展望。

InfoQ
推荐文章7

破局模型推理困局!华为张君详解昇腾“融合算力”的优化秘籍

华为高级开发工程师张君在AICon会演讲,围绕模型推理优化,从模型、框架、算子层展开,结合案例阐述技术方案。分析模型推理现状挑战,介绍加速技术,分享昇腾硬件算子优化实践及通算融合算子优化方法。

InfoQ
推荐文章8

从传统编程转向模型编程

文章指出模型编程时代,开发者要从‘代码产出者’变为‘文档定义者’,介绍其优势、人+AI结对编程模式,还提及模型工具技巧、开发流程、常见陷阱及应对策略,强调文档驱动和安全合规。

阿里云开发者
算法论文8

ACL 2026|证据摊开看,场景图画清:让流式视频模型拿捏「何时开口」

随着多模态和语言模型发展,人类与 AI 交互走向共生。现有视频模型难把握响应时机,西北工业学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。

机器之心
算法论文7

Fable5仅做对3.5%!模型会看图,但还没有主动视觉

本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。

机器之心
算法论文8

ICLR 2026|多模态模型真的理解情绪吗?MME-Emotion给出了系统答案

多模态模型迅速发展,但能否理解人类情绪存疑,且缺乏系统性评测框架。香港中文学和阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为后续研究提供参考。

机器之心
产品应用8

模型推理的“左右脑”革命!华为盘古Embedded凭昇腾之力,让快慢思考合二为一

传统模型推理面临长链条深度思考与低时延反馈的矛盾,华为盘古团队提出盘古Embedded模型。基于昇腾NPU,其采用双系统认知架构,集成“快思考”与“慢思考”双推理模式,实现推理效率与精度协同提升。

机器之心