表格处理」共找到 1026 篇相关文章

新闻资讯7

科学界论文高引第一人易主!AI站上历史巅峰

深度学习三巨头之一Yoshua Bengio成各领域被引最多在世科学家。其多篇论文为深度学习奠基,影响自然语言处理等研究。他近期再创业,还介绍了论文引用排名情况,凸显AI和医学热度。

量子位
产品应用8

4K-Agent:可将低分辨率图像提升至4K高清智能体

图像超分辨率技术在多种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其多智能体架构能将低分辨率图像提至4K高清,在多领域测试表现出色。

AIGC开放社区
算法论文7

SnapMoGen:44 小时动作数据 + 12 万文本注释,文本驱动动作生成数据集

近年来文本驱动动作生成有进展,但受限于数据集质量。Snap团队提出SnapMoGen数据集和MoMask++模型。前者有2万条动作片段和12.2万条文本描述,后者建模更有效,还结合LLM提升适用性,但二者都有局限。

带你学AI
算法论文8

LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25

最新研究发现模型规模和通用语言能力与处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理和推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。

新智元
推荐文章7

「Tokens是胡扯」,Mamba作者抛出颠覆性观点,揭露Transformer深层缺陷

Mamba作者Albert Gu在博客中探讨状态空间模型(SSM)和Transformer权衡,抛出‘Tokens是胡扯’观点,揭露Transformer深层缺陷,如分词问题、处理噪声能力弱等,还分析两类模型特点及结合优势。

机器之心
产品应用8

千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战

多模态大模型在多领域需求增长,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。

InfoQ
开源动态8

长篇动画上色稳如老狗!全新开源LongAnimation

动画上色是制作长篇动画时“烧脑”又“烧钱”的环节,现有AI主流方法多为局部处理,易导致色彩漂移、风格不统一。中国科学技术大学团队提出动态全局 - 局部范式,构建LongAnimation框架,可确保长动画色彩一致。

带你学AI
算法论文8

华为多路径推理破解大模型数学瓶颈,准确率超97%|ICML 2025

大模型处理复杂问题常“翻车”,华为诺亚方舟实验室提出思维森林(FoT)框架,借鉴人类认知方式,打破线性推理范式。FoT在多个数学推理任务表现出色,准确率超先进模型,将在ICML 2025开源。

量子位
产品应用8

嚯!国产视频模型的物理水准超神了 | 实测MiniMax海螺02

MiniMax上新视频生成模型Hailuo 02,解决了AI视频生成中体操难题。该模型原生支持1080p,能处理极端复杂物理场景,实测文生、图生视频能力出色,成本创新低,MiniMax本周还有多项技术布局。

量子位
产品应用7

蚂蚁多模态统一框架Ming-Omni:能看懂世界、会说话、还能画画

文章介绍蚂蚁多模态统一框架Ming - Omni,它可统一处理图像、文本等多模态数据。该框架解决了多模态训练中模态表示差异、收敛速度不一致等问题,采用分阶段预训练,能用于图像、音频生成及多模态交互。

CourseAI