技术与文化」共找到 8085 篇相关文章

开源动态8

ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态

滑铁卢大学快手可灵团队提出 UniVideo,是支持视频理解、生成编辑的多模态模型。它采用双流架构,结合 MLLM MM - DiT 能力,统一 10 个多模态任务,在多项基准超现有方法,代码已开源。

机器之心
产品应用7

newtype OS操作手册

作者黄益贺介绍newtype OS安装、配置使用方法。它是定制化工具,比Claude Code更适合知识消化内容产出。安装简单,配置需连模型供应商、给Agent配模型,使用时Chief对话即可。

newtype AI
推荐文章7

为什么 AI 搞不定体力活——对话清华大学刘嘉:这才是生物智能最难攻克的“万里长征” | 万有引力

本文是对清华大学刘嘉教授的访谈。他回顾 AI 研究经历,谈 AI 寒冬、研究错误及第一性原理,还分析学术界工业界差异、AI 现状挑战,指出大模型缺创造力,人应 AI 共进化。

AI科技大本营
算法论文8

大象秒变挖掘机!三维变形新突破,无需额外训练 | CVPR'26

南京大学北京大学提出MorphAny3D,无需额外训练即可让三维生成模型实现跨类别平滑变形。它通过创新注意力机制融合源目标特征,精准控制结构时序,效果远超传统方法,代码已开源。

新智元
算法论文8

ERNIE 5.0:走向原生统一的万亿参数多模态基础模型

过去多模态模型‘拼接式’方案存在理解生成割裂问题,ERNIE 5.0 借此提出,用统一自回归框架做多模态理解生成,在架构、训练系统层面有创新,评测中各模态能力表现出色。

深度学习自然语言处理
新闻资讯7

郎园 Station活动|当 AI 遇见生命科技 爱康 AI 生命展落地仓酷

8月19 - 22日,爱康AI生命展落地郎园Station仓酷。展览将艺术、光影科技融入空间,结合AIGC医学科普,设七大展区,呈现AI精准医学碰撞的可能,让健康管理更直观可感。

郎园Station
算法论文8

空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer

香港科技大学谭平教授团队地平线团队发布3D场景表征大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取定位重建,在多数据集上表现优于现有方法。

机器之心
产品应用8

小米AI语音新框架:人人都能当声音导演

小米大模型应用团队提出Midasheng - audio - generateXiaomi Any2Speech两大音频生成框架。前者可实现全场景声音重建,后者让AI学会理解声学空间叙事逻辑,改变了语音合成应用场景思路。

量子位
产品应用8

Macaron 新版本拆解:三个信号,看懂 Personal AI 的进化路径

Macaron新版本技术视频技术浓度超预期,结尾藏产品更新彩蛋。此次更新社交功能、Daily Spark、记忆打通等背后,藏着Personal AI关键变化,其团队Mind Lab有技术突破,开源方案获高认可。

特工宇宙
推荐文章8

传感器如何赋能精细化工行业?丨郭源生细说传感器

文章聚焦精细化工行业的智能传感器,阐述其应用前景、产业现状等。指出传统传感器短板,介绍前沿技术传感器融合方案,预测市场规模用量,分析智能化瓶颈并给出突破路径建议,推动行业高端化升级。

芯师爷