多模态方法」共找到 1356 篇相关文章

新闻资讯7

YC点名创业向:AI欺诈猎手,可能干掉整个反欺诈行业!

2026年春,YC发布的RFC清单中,‘政府欺诈猎手基础设施’引发关注。传统反欺诈存在‘非对称竞争’,而智能体技术为防守带来翻盘机会。构建AI原生业务模型,可让防守获结构性优势,但要解决安全与合规问题。

新智元
算法论文7

R1/Qwen训练新范式:无需继续训练,直接“算”出权重,提效500%

DeepSeek - R1爆火让RLVR成大模型后训练焦点,但训练代价高昂。学者发现RLVR中LLM权重和输出概率呈线性变化,提出“权重外推”等,实现最高6.1倍训练加速,RL - Extra在多榜单展现高效率。

PaperAgent
算法论文8

ENG APPL COMP FLUID | 西北工业大学赵书乐、张伟伟:欧拉程嵌入的壁面压力和摩阻分布机器学习

传统气动力建模依赖大量样本、泛化能力弱。本文将欧拉程无粘特征融入建模,配合架构与损失函数设计,让模型在复杂状态保持泛化能力,集中力误差约3%,小样本建模时样本量比传统降2倍以上。

力学与人工智能
新闻资讯7

下一站AI创业主线:别卷模型了,把这件事干成才重要

在AGI Playground 2025上,极客公园张鹏与三位投资人探讨Agent时代投资。他们认为AI创业进入「拼交付」时代,多模态短期影响被高估、长期潜力被低估,通用Agent是巨头之争,垂直Agent是创业机会,还会催生新基础设施,付费模式向按结果付费演变。

Founder Park
算法论文7

一个运行了80年的算,我们现在才真正理解它?

近80岁的单纯形是优化领域基石,广泛用于包裹配送、飞机航线规划等,但此前没人能从理论上完美解释其高效原因。现在,Huiberts和Bach找到了谜题的最后一块拼图,不仅让算更快,还从理论上解释了现象。

机器之心
推荐文章8

GPU-MODE Leaderboards之nvfp4_gemv代码阅读

文章围绕GPU-MODE的nvfp4_gemv竞赛rank1代码展开,先介绍问题及官baseline,后详细解读rank1代码,含数据加载、线程模型等,还剖析核心计算函数,最后总结代码在缓存控制、数据格式等面的调优亮点。

GiantPandaLLM
开源动态7

上新:Cache-DIT 支持LTX-2模型

作者和DefTruth在Cache-DIT上支持了LTX-2模型,记录适配关键点,包括模型侧、框架侧适配。介绍LTX-2特点,如支持T2V/I2V、输出带音频,还说明Cache-DIT加载区分T2V/I2V及cache侧修改内容,最后给出使用示例。

GiantPandaLLM
推荐文章7

2025,大模型文档解析(OCR)年终盘点

2025年6月以来文档解析快速增长,有10余种。按“技术路线 + 工程形态”可归为4大类:传统级联流水线、轻量多模态两段式、通用多模态大模型一段式、轻量多模态一段式,各有优劣,4条路线覆盖所有OCR落地场景。

PaperAgent
新闻资讯7

笑死,人形机器人运动会全是鬼畜名场面!这锅粥大家来趁乱喝了吧

首届人形机器人运动会在国家速滑馆举行,现场状况频出,如机器人撞人逃逸、摔倒、抢球混战等。比赛项目多样,包括足球、拳击等。解说重点是AI知识,比赛规则也为机器人量身定制。

量子位
算法论文8

蒸馏效果起飞!DOPD破解「特权幻觉」,让在线策略蒸馏更有效

近期,新加坡国立大学等团队提出 DOPD 解「特权幻觉」难题。该依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。

机器之心