「音频超分模型」共找到 8959 篇相关文章
让思考更准更长!强化学习新算法FIPO来了
阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。
Sam Altman:超级智能近在眼前!OpenAI官方13页蓝图引爆海外社区
OpenAI CEO Sam Altman 在 Axios 采访中称超级人工智能到来比预期快,社会需新契约管理。OpenAI 提出‘智能时代的产业政策’,含设公共财富基金、征机器人税等提案,还谈到下一代大模型。
Sand.ai重磅更新MagiAttention,正在定义分布式Attention性能新标杆
2025年4月,Sand.ai开源MagiAttention v1.0.0。如今发布v1.1.0,适配Blackwell新架构,构建原生Group Collective原语,经系统级协同优化,在多模型训练中得到实证,展现卓越性能。
鹅厂门口免费装龙虾,几百人排爆了!一代人有一代人的鸡蛋要领
腾讯云工程师在鹅厂门口免费为几百人安装OpenClaw,提供“从装到玩”服务。OpenClaw是开源智能体框架,像“龙虾”,可自动操作电脑。目前GitHub Star数超27.04万,多家公司跟进。
阿里 Qwen3-TTS 全新上线!支持9种方言+49种音色,连天津味儿都拿捏了!
阿里通义团队上新 Qwen3-TTS 文本转语音模型,主打拟人语音表达、丰富音色体系与多语言多方言能力。有 49 种高保真音色,支持 10 种语言、9 种方言,还能智能调节语速和韵律。
被误解的谷歌和百度。
文章指出大模型竞争短期拼产品体验,长期靠系统化落地能力。谷歌和百度虽被误解,但前者在I/O大会展示AI布局,后者营收利润双增,两家都构建生态,在AI下半场迎头赶上。
Google I/O 2026 | 开发者主题演讲精华集锦
在今年 Google I/O 大会上,谷歌发布 Gemini 3.5 系列模型,升级 '智能体优先' 开发平台 Antigravity,展示新工具和技能,助力开发者构建应用,还介绍了多项新技术及功能,另有招募活动。
本周 5 个火火火的Github开源项目,太香了!
文章介绍了本周5个热门GitHub开源项目。有能生成城市地图海报的MapToPoster,离线翻译工具Argos Translate,终端历史增强神器Atuin,轻量超高效版OpenClaw的PicoClaw,以及开源轻量级文本转语音工具Pocket TTS。
苏妈和李飞飞炸场CES!AMD AI全栈野心显露:从云端到个人PC,AI芯片性能四年要飙1000倍
今年 CES 上 AMD 专场演讲亮点多。苏姿丰称未来五年50亿人每天用 AI;李飞飞和她探讨空间智能与世界模型;Helios 平台受关注,MI455 GPU 解决内存墙;Ryzen AI 推动 AI 下放到本地。
Self-evolving Agents过程并非总是良性的,要警惕这些“错误进化”风险
近年来,基于大语言模型的智能代理成为热点,自进化代理可自我改进。但论文指出其进化可能“跑偏”,出现“错误进化”,并揭示了不同进化路径的风险,还提出缓解策略,呼吁重视其安全性。