「多语言支持」共找到 5481 篇相关文章
Speech-02语音模型登顶国际榜单:完美复刻声音,同事听后难辨真伪
MiniMax的Speech-02语音模型登顶国际榜单,超越OpenAI等海外模型。它引入可学习说话人编码器,有高扩展性,还能结合文本描述生成音色。测试显示其音色丰富、读音准、支持多语种,声音复刻逼真。
龙虾惨遭卸载,OpenAI 最新博客:Agent 的安全隐患,可能永远无解
OpenAI 博客指出 AI Agent 安全隐患或无解。三大 AI 巨头投入防御,仍难抵攻击,如 OpenClaw 就出现多起安全事故。其根源是大语言模型架构缺陷,不过‘不可解’不等于‘不可控’,业界已有应对策略。
机器人WAIC现场抢活讲PPT?商汤悟能具身智能平台让机器人「觉醒」
具身智能火爆但面临数据瓶颈等难题。商汤在WAIC推出具身智能平台「悟能」,以世界模型为引擎,有感知、导航、交互等功能,其开悟世界模型能生成多视角视频,为机器人提供数据支持。
蚂蚁首次投向机器人“指尖”!数亿元押注,全球首个物理交互脑发布
8月11日,戴盟机器人完成数亿元战略轮融资,由蚂蚁集团领投。蚂蚁此前已在具身智能赛道多处布局,此次是首次延伸至触觉感知层。戴盟推出全球首个“物理交互脑”,有稀缺团队支撑,多方面获产业支持且多项指标全球领先。
一手实测深夜发布的世界首个设计Agent - Lovart。
博主实测深夜发布的世界首个设计 Agent - Lovart。虽内测版细节粗糙,但大框架已现。它先匹配设计风格,再创建执行计划,还支持二次编辑等,集成多工具可生成视频等,未来或重写设计工作流。
Claude 小升级就赢了OpenAI 9年“开源神作”?高强度推理直接歇菜、幻觉率高达50%,写作还被Kimi 2吊锤?
OpenAI发布首个开源语言模型系列gpt - oss,包括gpt - oss - 120b和gpt - oss - 20b,可在Hugging Face下载。同期谷歌、Anthropic也有新模型推出。gpt - oss有亮点,但也存在幻觉率高、实测效果差等问题。
HF日趋榜一!真端到端模型AutoDeco终结手动调参解码
大语言模型手动调参解码繁琐,腾讯AI Lab王琰团队联合港中大(深圳)唐晓莹教授团队推出AutoDeco架构,通过创新训练策略让模型动态预测解码参数,在多模型实验中表现出色且已开源。
万物皆可AI的时代?Arm发布全球首个Armv9边缘AI计算平台
Arm发布全球首个Armv9边缘AI计算平台,核心是Cortex - A320 CPU和Ethos - U85 NPU,能让小设备本地运行超10亿参数AI模型。边缘AI市场增长快,Arm转型切入,平台软硬结合优势明显,还有豪华朋友圈支持。
谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!
当地时间 6 月 23 日,Linux 基金会宣布与多公司成立 A2A 项目,由谷歌捐赠协议规范等。A2A 支持智能体通信协作,谷歌称其将在中立治理下开发普及。此外还对比了 A2A 与 MCP、ACP 等协议,探讨实际应用问题。
智谱AI、清华开源新视觉大模型:刷新41项纪录,同级别最强
智谱AI与清华联合开源GLM - 4.5V视觉大模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。