多语种竞赛」共找到 4258 篇相关文章

算法论文8

李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!

全行业为昂贵视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。

新智元
开源动态8

浙大联合北大开源 Easel:一个 Agent 包办社媒全链路,从热点发现到平台发布!

浙江大学和北京大学联合开源Easel,这是面向社媒创作者的内容工作台,用一个Agent打通全链路,有画像驱动等六大亮点,还给出清晰的快速上手流程。

开源星探
产品应用7

卡帕西大模型横评方法太好玩了!四大AI匿名参赛评分,最强出乎意料

卡帕西发布“大模型议会”web app,系统通过OpenRouter调起模型开会商议,各模型答题、互评、排序,由主席模型给出统一答案。可对比模型差异,模型自评与人类主观或不同,模型集成或成突破点。

量子位
算法论文8

自适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出模式自适应路由,实现模式自适应切换,在基准测试中效果与效率双升。

深度学习自然语言处理
开源动态8

大模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一

个机构研究人员联合发布全新语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有大模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试。

量子位
新闻资讯7

Win11 已近乎“残废”?微软承认个核心功能崩盘,锅要甩给 AI 编程吗?

近期微软麻烦不断,先是部分Microsoft 365服务故障,Windows业务负责人公布的计划也遭不满。英伟达指出Windows 11更新影响游戏效能,微软承认其存在系统性问题,个核心功能故障已持续四个月,官方正修复并给出临时方案,引发社区吐槽。

InfoQ
产品应用7

AI陪伴Top 1应用上线视频生成!图片人物能说话唱歌,轮对话场景依然稳定

AI陪伴应用Top 1的Character.ai(c.ai)上线视频生成功能AvatarFX,可让静态图片人物“开口说话”。c.ai还上新项AI创作功能。此外,谷歌收购c.ai遭美国反垄断调查。

量子位
产品应用8

4K-Agent:可将低分辨率图像提升至4K高清智能体

图像超分辨率技术在种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其智能体架构能将低分辨率图像提至4K高清,在领域测试表现出色。

AIGC开放社区
开源动态8

阿里重磅开源 0.5B TTS + 0.8B ASR,支持跨语种音色克隆、说唱识别!

2025 年 AI 圈风向变了,开始卷端侧模型。阿里 FunAudioLLM 团队发布 Fun - CosyVoice3 0.5B 和 Fun - ASR - Nano 0.8B,TTS、ASR 双线程开源,是工程级版本,目标是在本地跑顺‘听 + 说’。

开源星探
开源动态8

英伟达4段简短提示词,IOI夺金!开源模型也能征服最难编程竞赛

英伟达研究者提出GenCluster框架提升开源LLM解题能力,让开源模型gpt - oss - 120b在IOI 2025获金牌级别高分。它执行‘海选+筛选+比拼+提交’流程,优势明显,标志开源AI里程碑式突破。

新智元