「多端发布」共找到 3056 篇相关文章
阿里发布Qwen3-TTS:跨语言混合无缝切换,方言音色全面覆盖!
TTS技术从单一合成进化到多模态表达,但传统模型在跨语言/方言混合场景有不足,商业工具费用高且不开源,开源方案训练数据少。阿里推出Qwen3 - TTS,实现人类级自然度和表现力,功能强大,应用场景多。
ICCV 2025 | 港科、牛津大学发布AlignGuard,文图生成模型可规模化安全对齐框架
随着文图生成模型广泛应用,其安全防护机制有限。ICCV 2025上,港科、牛津大学推出AlignGuard,是文图生成模型可规模化安全对齐框架,通过生成CoProV2数据集等实现安全对齐,实验效果佳。
智元机器人发布并开源首个机器人动作序列驱动的世界模型
近日,智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,打破具身智能演进制约。
突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌
消息称Anthropic本周将发布Opus 5.1,其升级聚焦单Token智能水平,强化编程、推理、AI Agent能力;OpenAI 10万亿参数模型Bel完成预训练;企业选模型‘够用就好’,Anthropic Fable 5份额低。
中国开源首超美国:Hugging Face发布全球AI开源现状报告
Hugging Face发布报告显示,2025年开源AI生态繁荣,用户参与度高。中国首次超越美国,成月下载量最大的模型来源国。各国政府推动主权AI,硬件支持更多元,机器人和科学领域发展迅速。
arXiv禁用AI,糊涂!18所高校联合发布首个AI科研评审平台
arXiv因AI生成论文泛滥,禁止接收未经同行评审的综述和立场论文。而18所高校联合发布的aiXiv平台,支持AI和人类共创科研成果,采用多阶段AI同行评审机制,引发对传统学术体系的反思。
快手发布Keye-VL-1.5,同量级SoTA,让模型真正看懂视频!
近年来,多模态大语言模型兴起,但视频理解仍是难题。快手Keye团队推出Keye-VL-1.5,通过Slow-Fast编码策略、渐进式四阶段预训练和全面后训练流程等创新,实现视频理解突破,综合性能领先。
智元机器人发布并开源首个机器人动作序列驱动的世界模型
智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,解决具身智能演进制约,提升策略模型筛选与训练效率。
谷歌发布Nano Banana官方保姆级开发教程,代码给你喂到嘴边
谷歌为Nano Banana新模型发布官方保姆级开发教程。介绍了使用Google AI Studio免费测试方法,阐述环境准备,如获取API key、设置结算账户、安装Gen AI SDK,还展示代码实战,以及和模型沟通的技巧。
谷歌智能体发力:增强版Gemini Deep Research和专属API都来了
OpenAI强势更新,谷歌也没闲着。正式发布增强版的Gemini Deep Research,配套推出DeepSearchQA基准测试集,还发布了Interactions API,这不仅是Deep Research升级,还是Gemini生态的大升级。