「多语言大模型」共找到 9933 篇相关文章
刚刚,创智+模思发布开源版Sora2,电影级音视频同步生成,打破闭源技术垄断
今天上午,上海创智学院 OpenMOSS 团队与模思智能发布端到端音视频生成模型 MOVA,它是中国首个高性能开源音视频模型,能实现音画同出,全栈开源打破闭源技术垄断。
Self-Evolving Agents,AI的“自我革命”
LLMs静态性成应用瓶颈,自演化智能体成破局关键。本次分享的综述围绕演化什么、何时演化、如何演化三个核心问题展开,介绍了模型、记忆等方面的演化内容、时机和方式。
狼人杀AI对决:手把手教你打造高分Agent
作者参加AI狼人杀比赛,分享构建高分Agent全过程。介绍比赛规则、题目挑战及解题思路,阐述Agent基础能力,如缓存、并发集成等,还提及模型调优、战术策略,最后开源代码,分享心得体会。
机器人学会“脑补”触感,叠衣服端茶水成功率暴涨90%
近年来,人形机器人研发从行走转向复杂操控,但处理精细家务表现逊色。卡内基梅隆大学联合博世人工智能中心团队提出 HTD 模型,让机器人预判触觉,在 5 项任务上成功率提升 90.9%,部分代码开源。
解读Qwen3文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
告别天价API账单!开源Chatterbox语音服务器上线,隐私与效率双赢!
第三方语音合成API成本高、有隐私风险,直接部署开源模型配置复杂。开源的Chatterbox-TTS-Server基于Chatterbox TTS模型,有Web界面、声音克隆等功能,支持GPU和Docker,可解决部署难题。
天塌了,Claude 全面断供Windsurf!CEO喊冤控诉也挡不住开发者退订,祸起OpenAI收购?
当地时间6月4日,Anthropic切断Windsurf几乎所有Claude 3.x模型访问权限。此前Anthropic就拒绝为Windsurf提供Claude 4系列模型支持。有观点认为这与OpenAI收购Windsurf有关,但双方未承认。
刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望
本文报道SpaceXAI发布新款大模型Grok 4.7,该模型定位面向编程与知识工作,主打速度翻倍、价格仅为同类一半,强化长任务处理能力,跑分表现引发网友争议。
Github 1.8K star厉害!!有了这个办公AI神器,效率飙升!
Speakr是完全自托管的AI会议助手,能将音频转文字、生成摘要、进行内容问答,离线运行保障隐私和安全。它功能丰富且轻巧,支持多平台,GitHub已破1.8K star。
每2秒吃透一道高数大题!华为终于揭秘准万亿MoE昇腾训练系统全流程
华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现大模型高效训练。