多语言支持」共找到 5479 篇相关文章

产品应用8

Skywork AI | 发布Super Agent,一站式搞定写作、开发、分析与创意内容生成

去年谷歌定义了Agent,如今随着大模型发展其能力升级。Skywork AI推出Super Agent平台,有5个专家AI agent和1个通用AI agent,能生成类型内容且支持溯源。它突破行业瓶颈,还开源相关框架和MCP。

AINLPer
算法论文8

华人团队终结Token危机:扩散模型数据潜力超自回归三倍

最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。

量子位
开源动态8

小红书最新开源TTS力作!4人对话自然无缝,毫秒极速响应!

近年来TTS技术爆发,但人对话的自然流畅性和长序列稳定性一直是难点。小红书团队开源的FireRedTTS - 2是面向人对话场景的TTS模型,实现自然切换和低延迟,支持语言,适用于种场景。

开源星探
产品应用8

顶尖开发者都在用 skills.sh热门技能

发现全能Skills网站https://skills.sh/,它是Open Agent Skills Ecosystem载体,解决AI Agent能力碎片化等问题。提供一键安装的技能模块库,支持主流AI Agent适配,有技能排行榜,还能解决AI Agent的能力痛点。

CourseAI
新闻资讯8

Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键

Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与模型交互、模型可解释性等,认为未来会有白领 AI 员工。

Founder Park
开源动态8

NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下模态冠军!

英伟达推出全模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,测试中大幅超 Qwen2.5 - Omni,且训练量仅为其六分之一。其架构经阶段流程实现全模态理解,还支持种功能。

带你学AI
开源动态8

阿里AI 重磅第4发:电影级MOE 视频模型Wan2.2正式开源!

阿里通义团队开源电影级视频生成模型Wan2.2,将光影、色彩、镜头语言装进模型,支持60参数自由组合。它是业界首个用MoE架构的视频生成模型,推理省计算资源,性能超主流模型,获国外网友盛赞。

AGI Hunt
产品应用8

奥特曼亲自上阵,Images 2.0登顶王座!大米刻字,生图跨入GPT-5时代

OpenAI上线ChatGPT Images 2.0,奥特曼称其是从GPT - 3到GPT - 5的飞跃。它是首个‘会思考’的图像AI,能精准听懂中文指令、渲染复杂UI,在Arena榜单登顶,解决了语言、风格等痛点。

新智元
算法论文8

CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍

随着高分辨率图像与长视频处理需求增长,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。

机器之心
产品应用7

CES 2026趋势照进现实:算力引擎RK182X重塑千行百业,瑞芯微AI生态大会共建落地生态

CES2026推动AI走向现实应用,瑞芯微RK182X作为AIoT2.0算力引擎,在视觉语言和大语言模型表现卓越,支持Qwen3 - VL系列模型。它在音频体验、领域赋能出色,瑞芯微还构建产业生态促场景落地。

机器之心