中文渲染」共找到 240 篇相关文章

开源动态7

国内首套:港中文团队发布7模态人体动作数据集,揭开大模型理解能力短板

中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主流大模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。

DeepTech深科技
算法论文8

面对无解问题大模型竟会崩溃?港中文&华为联合提出首个大模型推理可靠性评估基准

中文和华为诺亚实验室联合提出ReliableMath基准,探究大模型推理可靠性。提出评估准则,构建含可解与不可解问题的ReliableMath数据集,实验揭示大模型缺陷,还提出提高可靠性的对齐策略。

机器之心
算法论文8

5秒完成3D场景编辑,北大&港中文&上海AI Lab搞出VGGT-Edit,120倍加速太炸了

北大、港中文等团队提出原生3D编辑框架VGGT-Edit,不再绕回2D,直接在3D空间编辑。它采用残差场预测等机制,在DeltaScene测试集表现出色,单次编辑约5秒,最高120倍加速。

量子位
算法论文8

腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式

过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。

AI科技评论
算法论文8

联合理解生成的关键拼图?腾讯发布X-Omini:强化学习让离散自回归生成方法重焕生机,轻松渲染长文本图像

图像生成领域,自回归与扩散模型技术路线之争不断。腾讯混元团队发布X-Omni模型,通过强化学习提升自回归图像生成质量,能渲染长文本图像。该模型已开源,还构建奖励系统评估生成质量。

机器之心
开源动态7

李飞飞空间智能独角兽开源底层技术!AI生成3D世界在所有设备流畅运行空间智能的“着色器”来了

李飞飞创立的World Labs开源核心技术Forge渲染器,可在各设备实时、流畅渲染AI生成的3D世界。它是Web端3D高斯泼溅渲染器,地位似传统3D领域“着色器”,还解决了3DGS渲染难题。

量子位
开源动态8

美团开源LongCat-Image,6B参数挑战80B效果,中英双语理解、图像逼真度及复杂指令编辑新突破

美团开源6B参数图像模型LongCat-Image,在双语文本理解、图像逼真度及复杂指令编辑任务中表现出色。它以轻量化设计超越大模型,还解决中文文本渲染难题,有精确图像编辑能力,且提供全链路开源方案。

AIGC开放社区
产品应用7

观猹,中文互联网最大的谐音梗 AI 社区

本文介绍了「观猹」平台,它被称为「中文互联网最大谐音梗社区」。其名字谐音「观察」,还有「猹馆」谐音「茶馆」,活跃成员群名也玩梗,平台还开了「瓜棚」即商城,会持续丰富内容。

特工宇宙
算法论文7

3D多光照场景渲染!GRGS带来真实感重光照

哈工大提出通用3D高斯框架GRGS,用于多样光照下高保真人体新视角合成。它采用前馈监督策略,支持可编辑光照,结合物理着色与神经网络推断,合成逼真效果,但处理透明材质和纤薄结构欠佳。

带你学AI
新闻资讯7

马斯克版微信亮相:支持中文,加密聊天,还专门防截屏

马斯克版微信XChat将于4月17日上线,支持中文版。其核心主打加密聊天,功能有文字、图片等发送及视频通话,还内置Grok模型。不过网友质疑其难成功,因X已有聊天功能,且微信生态难撼动,市场竞争大。

量子位