多模态数据」共找到 3187 篇相关文章

算法论文8

LangFlow: 挑战离散扩散,探索下一代语言模型新范式

UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。

机器之心
新闻资讯7

稚晖君家智元没参展机器人大会,合着是人家自己办(doge)

这是智元机器人首届合作伙伴大会现场画面。前段时间世界机器人大会没智元身影,原来它有自己的大会。现场机器人表现多样,有比心、穿梭、自主讲解等,还有真机数据采集、流水线分拣等工作场景。

量子位
算法论文8

用SFT打出RL的效果?微软联合提出高效后训练算法

大模型后训练阶段,SFT 和 RL 各有优劣。微软等联合提出新工作,量化 SFT 和 RL 在数据层面的差距,提出 IDFT 和 Hinted Decoding 等高效后训练技术,实验显示新方法泛化超 SFT、效率超 RL。

机器之心
开源动态8

刚刚国产双响炮炸场!智谱「牛来模型」和阿里Qwen3.8-Flash双双亮相屠榜

智谱发布GLM - 5.3 - Flash(牛来模型),原生多模态,支持1M token上下文,运行在国产芯片,价格实惠。阿里开源Qwen3.8 - Flash - Next权重,成本低性能优,在四大维度重构架构。

AI寒武纪
算法论文8

刚刚,Anthropic这篇论文上了Natrue

Anthropic关于“潜意识学习”的研究发表于《Nature》杂志。研究揭示大语言模型能通过与语义无关的数据传递行为特征,如偏好、不对齐行为等,还探究了其机制,并在MNIST上验证。

PaperAgent
开源动态8

硅谷豪赌算力烧到停电,中国团队反向出击!这一刀,直接砍碎Scaling Law

硅谷陷入算力战争,OpenAI、马斯克等豪赌Scaling。但Anthropic指出模型大、算力多不一定聪明。Yuan 3.0 Flash登场,用RAPO+RIRM解决过度思考,降低推理token,在多模态任务表现出色,引发开发者关注。

新智元
新闻资讯8

英伟达Jim Fan:「世界建模」是新一代预训练范式

英伟达机器人主管Jim Fan判断,继“下一个词预测”后,世界建模将成新预训练范式,2026年大世界模型将为多模态AI奠基。他还讨论世界模型定义、应用,展望新推理形式,业内人士也各抒己见。

量子位
开源动态8

基于seekdb,教你从零开始构建智能搜书应用

OceanBase开源AI原生数据库seekdb,它统一处理多种数据,解决AI开发者难题。文章分享上手体验,介绍其优势、适用场景、玩法,还给出基于它实现智能搜书应用的教程。

机器学习AI算法工程
算法论文8

刷榜自动驾驶语义场景补全!北大新作:高维度、高密度 | AAAI'26

北京大学彭宇新教授团队提出视觉语义场景补全方法HD² - SSC,通过高维度语义解耦和高密度占用优化,解决现有技术维度与密度差异问题,在两自动驾驶数据集上取得最优性能。

新智元
产品应用8

Sora爆火之际,这家AI公司的DAU正以每月翻倍速度狂奔——Agnes

OpenAI的Sora爆火,而AI Agent产品Agnes正走不同路线。它三个月内全球注册用户破百万,DAU逼近10万,ARR达780万美元且近乎每月翻倍。其多模态社区预计10月上线,追求“Vibe Lifestyle”理念。

花叔