多语言建模」共找到 4946 篇相关文章

算法论文8

Communications Engineering | 西湖大学&女王大学:面向阵风气动建模的表面压力时空动力学关联研究

西湖大学联合女王大学团队提出 Graph Transformer 框架用于阵风气动建模,融合图神经网络与注意力机制,从表面压力信号学时空关联,实现气动力准确预测,为AI在复杂气动建模提供新思路。

力学与人工智能
产品应用8

超脑未来WorldDreamer V4横扫个权威榜单,世界模型进入群体智能时代

超脑未来发布 WorldDreamer V4,它以智能体为基本单位,具种核心能力。采用新预训练架构,引入 Masked Agent Modeling,用共享隐式世界状态带来新协同范式,还在权威榜单领先。

机器之心
开源动态8

“甲方快乐模型”诞生,拿下平面设计新SOTA!条件一键生成,还能独立调整元素 | 复旦&字节

复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在维度评估基准上表现出色,还支持轮编辑。

量子位
新闻资讯7

2026“企业 Agent 上岗元年”?零一万物六大判断定义企业智能体,不再沿用大厂标准化产品模式”

1月5日,零一万物发布《中国企业智能体2026六大预判》,展示“万智2.5企业智能体”。基于实践总结六大核心预判,还升级万智平台,不沿用大厂标准化模式,规划企业智能体进化“三步走”布局。

AI前线
开源动态8

通义实验室正式开源 Mobile-Agent v3.5 及新一代平台 GUI Agent 基座模型 GUI-Owl-1.5

通义实验室正式开源 Mobile - Agent v3.5 及新一代平台 GUI Agent 基座模型 GUI - Owl - 1.5。该模型有档参数可选,分 Instruct 和 Thinking 版,支持平台。它解决了高质量数据难搞定等痛点,评测表现良好。

深度学习自然语言处理
算法论文8

视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26

镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。

量子位
算法论文8

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,VLA模型成通用机器人控制重要路线,但模型大、动作更新慢的矛盾凸显。华中科技大学联合华为提出TurboVLA,绕开大语言模型,形成V+L→A路径,降低成本,保持操作能力。

机器之心
新闻资讯7

神秘「欢乐马」霸榜视频模型!本以为Seedance2.0已封神…

神秘模型HappyHorse - 1.0悄然登顶Artificial Analysis的AI Video Arena排行榜,在个赛道力压Seedance等模型,呈现断层式碾压。它或出自阿里淘天未来生活实验室,据说完全开源,10号将正式发布。

量子位
开源动态8

1.4K标星!微软开源了一款全能AI客服系统,一键24小时实时对话!

数字化时代传统呼叫中心问题,成本高。微软在GitHub开源Call Center AI,基于Azure + GPT的智能语音客服系统,具项功能,采用三层设计,适用行业,可落地,或成企业标配。

开源星探
产品应用8

大涨240%,Doc-Researcher确立模态文档深度研究新范式

在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于产业场景。

PaperAgent