多语言建模」共找到 4934 篇相关文章

算法论文8

不再止步于自然语言!PhiZero让世界模型学会「物理语言

PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在基准测试中表现领先,为AI理解物理世界开辟新通道。

机器之心
算法论文7

SceneGen: 单图像驱动的资产3D 场景生成

上海交通大学提出SceneGen框架,可从单张场景图像及其对应目标掩码中,同时生成带有几何结构与纹理的个3D资产。它一次前向传播即可完成生成,在效率与稳健性上优于现有方法,虽有局限但应用潜力大。

带你学AI
开源动态7

纯本地隐私绝佳,没网也能翻,30+语言支持!

日常常用翻译工具依赖云端,有隐私风险。开源离线翻译项目`Argos Translate`,基于Python开发,支持语言互译,有种使用形式。虽翻译精度略逊,但隐私性好、可自由部署,适合有安全需求的用户。

开源先锋
算法论文7

CodeClash 通过轮编程竞赛对大型语言模型进行基准测试

为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让个 LLM 在轮比赛中较量,涉及种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。

InfoQ
算法论文8

CVPR 2026 三维视觉趋势梳理:从 RGB 感知,到真实世界建模

计算机视觉行业从追求识别能力转向关注视觉系统对真实世界的理解。CVPR 2026研究中,视角、事件视觉、开放集3D生成和相机运动轨迹被引入视觉理解,篇论文从不同侧面推动视觉系统走向对真实世界的理解。

AI科技评论
产品应用8

证明也有「选择困难症」?腾讯AI Lab与大模型研究部联手打造 MPS-Prover ,视角破解形式化推理瓶颈!

本文聚焦逐步式自动化定理证明器困境,腾讯AI Lab等提出MPS - Prover。它有数据筛选和视角树搜索两项创新,提升搜索效率和证明质量,在基准表现佳,还解决六道IMO难题。

AI科技评论
开源动态7

推出 AnyLanguageModel:在 Apple 平台统一本地与远程大语言模型的 API

语言模型是构建现代软件的重要工具,但 Apple 平台开发者集成模型困难。Hugging Face 发布 AnyLanguageModel,是 Swift 包,可替代 Apple Foundation Models 框架,支持模型服务商,降低使用 LLM 难度。

Hugging Face
新闻资讯7

The Batch: 867 | 印度推动本土人工智能建设

印度在资金有限、语言与方言众情况下,正加倍努力建设本土大模型。政府资助初创企业、调配算力,家公司研发语言模型,虽面临挑战,但旨在开发符合自身需求的人工智能。

DeeplearningAI
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
产品应用8

阿里发布Qwen3-TTS:跨语言混合无缝切换,方言音色全面覆盖!

TTS技术从单一合成进化到模态表达,但传统模型在跨语言/方言混合场景有不足,商业工具费用高且不开源,开源方案训练数据少。阿里推出Qwen3 - TTS,实现人类级自然度和表现力,功能强大,应用场景

开源星探