多语种支持」共找到 4821 篇相关文章

开源动态8

月之暗面刚开源模态Kimi-2506:智能体、视觉理解,重磅大升级

国内月之暗面平台对开源模态模型Kimi-VL-A3B-Thinking升级到2506版本。该版本性能、视觉理解等能力提升,支持更高分辨率,在领域表现出色,还介绍了模型组成与优化器改进。

AIGC开放社区
开源动态8

OpenClaw 3.24发布:彻底解决最重要的Skills安装障碍!

OpenClaw 3.24 发布,改动显著。Skills 安装更顺滑,系统自动检测依赖;控制台界面大改,侧边栏更易用;修复媒体文件访问漏洞;Microsoft Teams 支持升级;还修了平台群聊 Bug,新增 API 端点,提升 RAG 兼容性。

新智元
产品应用8

百亿向量,毫秒响应:清华研发团队向量数据库 VexDB 首发,攻克模型幻觉难题

9月25日,清华数智引航团队发布向量数据库VexDB,能支持百亿千维向量数据毫秒级查询,召回准确度超99%。它可解决大模型幻觉问题,已在领域深度应用,为企业AI转型提供方案。

AI前线
开源动态7

4.2w颗星!学术科研 AI 工作流

这是一套有4.2w颗星的学术研究技能包,涵盖研究到论文出版全流程。它不替写论文,接手搜文献等杂事。有四个核心skill,支持文献引用格式,能编译成PDF,还介绍了安装和使用方式。

GitHubStore
产品应用8

首批“数字员工”组团进大厂!7个岗位干爆KPI,提前锁定年度最佳企业级Agent

百度智能云发布7款数字员工,覆盖岗位,能提升业绩。它们支持“开箱即用”,具备四大核心能力,采用“超强双脑”架构。数字员工可打破传统AI工具局限,真正成为企业生产力。

量子位
开源动态8

ROLL:面向大规模语言模型的高效强化学习框架

本文介绍阿里推出的ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。在任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者
新闻资讯7

The Batch: 938 | Gemini 的音乐生成器

Google将音乐生成器Lyria 3加入Gemini和YouTube,它接收文本或图像生成30秒音频,支持语言歌词。在质量和遵循提示上优于前身,采取版权保护措施,对特定用户免费或提供高额度使用。

DeeplearningAI
产品应用8

阿里悟空全网首测

2026年OpenClaw引领AI Agent热潮,但对普通人不好用。阿里钉钉发布企业级AI原生工作平台悟空,预置行业OPT套件,实测能完成设计等工作,解决OpenClaw部署和安全问题,且有阿里集团战略支持

特工宇宙
开源动态8

1.9K Star 微软开源TTS王炸!90分钟超长语音合成,4人对话自然切换!

在文本转语音(TTS)领域,生成长篇、说话人的高质量音频一直是技术挑战。微软最新开源的VibeVoice TTS模型,可一次生成90分钟连续语音,支持4个不同说话人,还具备高效处理长序列等亮点特性。

开源星探
新闻资讯7

新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了

“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持语言推理,以纯RL方式训练,为LLM强化学习提供新范式。

量子位