多语言数据集」共找到 6485 篇相关文章

开源动态8

社区供稿 | VibeVoice实现90分钟、角色播客生成,拓展语音合成新边界

微软亚洲研究院提出全新语音生成模型 VibeVoice,采用 next - token diffusion 机制,能将文字脚本转为最长 90 分钟、最 4 人对话的高质量播客音频,在方面有显著优势,未来潜力大。

Hugging Face
开源动态8

告别 Selenium 痛点!全新升级版 Selenium 自动化框架,斩获10.2K标星!

Selenium 编写 Web 自动化脚本痛点,SeleniumBase 深度封装 Selenium,内置智能等待等功能,解决诸问题。它功能强大,安装使用简单,适用于场景,像“智能助手”让自动化测试变简单。

开源星探
新闻资讯8

具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据

AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在方面有突破,成果备受赞誉。

机器之心
推荐文章7

一文讲透程序编排的核心方式:从表达式语言到并行化实践

文章围绕程序编排展开,介绍单语句编排、类编排、流程编排、并行化编排等核心方式,分析种编排框架特点及适用场景,还提及Lindorm泛时序数据解决方案,为开发者提供编排参考。

阿里云开发者
算法论文8

JanusVLN:双重隐式记忆解耦语义与空间,开创视觉语言导航记忆新范式

视觉 - 语言导航(VLN)现有主流方法依赖显式记忆面临挑战,未充分利用3D线索。JanusVLN框架引入双重隐式神经记忆,解耦语义与空间信息,实验验证其性能、效率和泛化能力出色。

AI科技评论
算法论文8

Google研究发现:Multi-Agent的核心竟然是Prompt设计!

Google和剑桥大学研究智能体系统,发现提示设计影响大,有效拓扑结构占比小。提出Mass框架分三阶段优化,实验用Gemini 1.5 Pro和Flash模型,对比种方法,在任务上性能显著提升。

PaperAgent
推荐文章7

GAN之父Ian Goodfellow病后归来,剑指高效世界模型

GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件模态世界模型最佳路径,该模型可支持长时序任务预测与规划,还探讨构建原因、数据来源等。

机器之心
开源动态8

Github 8.7K star 厉害!!! 一款轻量好用的web自动化项目!

Nanobrowser是开源Chrome扩展工具,专注AI驱动的网页自动化。免费且本地运行,保护隐私,支持主流大模型。有智能体协同等特点,还介绍了安装配置方法,是高效安全的网页自动化之选。

开源先锋
产品应用7

AI开始学会合作?!实测4大Agent体=10个打工人

Agent热潮进入智能体时代,款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出Agent正推动大模型向“协作式智能群体”演进。

鲸选AI
算法论文8

华为路径推理破解大模型数学瓶颈,准确率超97%|ICML 2025

大模型处理复杂问题常“翻车”,华为诺亚方舟实验室提出思维森林(FoT)框架,借鉴人类认知方式,打破线性推理范式。FoT在个数学推理任务表现出色,准确率超先进模型,将在ICML 2025开源。

量子位