音频超分模型」共找到 8911 篇相关文章

产品应用7

AI驱动前端重构:10天完成3000+行复杂组件的跨端复用实践

本文分享阿里团队实践,用AI开发工具Cursor结合Claude模型,10天重构3000行前端组件实现跨端复用。介绍代码辅助、测试用例生产、代码智能生产经验,提出新开发范式,强调规范和人工校验重要性。

阿里云开发者
新闻资讯8

Claude Code把自己的提示词删掉80%,我照着砍了自己的60%

Anthropic将Claude Code系统提示词删减80%,编码评测表现无明显下降。文章阐述删减背后判断,给出六条变化策略、四类文件写法及两条方法论,还介绍实施步骤,作者按此精简提示词约60%。

花叔
开源动态8

机器人看不清,蚂蚁给治好了

天下苦机器人看不清透明和反光物体久矣,问题出在深度相机。蚂蚁集团具身智能公司蚂蚁灵波开源深度视觉模型LingBot - Depth,无需换硬件,用创新算法和大量数据提升性能,还将开源数据集。

量子位
开源动态8

“同事.skill”不用写了,爱马仕 Hermes 主动“蒸馏”你,还让开发者集体抛弃 “龙虾”?!

近日,Hermes Agent 在国内爆火,获 5.2 万 stars 且还在增长。它与 OpenClaw 不同,采用单 Agent 架构,有学习循环和分层记忆系统。背后公司 Nous Research 目标是打造抗衡 OpenAI 的开源模型,还引入区块链解决算力问题。

AI前线
新闻资讯9

刚刚,中国语音AI连拿多项全球第一!

本文报道阶跃星辰推出StepAudio 3全系列五款音频模型,覆盖听、说、理解、交互、创作全语音链路,拿下三项第三方评测全球第一,分析了语音AI行业从单点竞赛转向全栈体系竞争的新趋势。

新智元
产品应用8

32倍加速,58秒搞定720p视频!字节发布离散自回归框架,统一视觉生成和长视频生成

字节发布InfinityStar框架,将5秒720p视频生成时间从30多分钟缩至58秒,还支持多样任务。它基于对视频本质思考设计时空金字塔模型,将时空分离,通过多项技术优化,性能表现出色,不过也存在一些技术局限。

AIGC开放社区
产品应用8

Claude Opus 4.7炸场,6美元造《我的世界》,临门AGI前强调安全,打工人却更慌了

Anthropic 发布‘目前最强 Opus 模型’Claude Opus 4.7,能力跃升,在多榜单夺冠。写代码、看图表等能力提升,也有网页搜索等能力下降。还展现出游戏开发实力,同步上线Claude Code新功能,加强安全防护。

鲸选AI
新闻资讯8

Google一口气发了多少东西?I/O 2026完整梳理

Google I/O 2026发布会成果丰硕。token处理量大幅增长,13款产品月活10亿。对话式AI融入多产品,基础设施投入增至约1800亿美元。还发布新模型、平台及工具,构建从芯片到应用的Agent体系。

AI寒武纪
开源动态8

昆仑万维多模态视频生成开源,影音图文全统一

昆仑万维开源的SkyReels-V3,通过统一多模态上下文学习框架,实现参考图像生成视频、视频持续扩展及音频驱动虚拟数字人功能,在视觉质量与指令跟随性上逼近闭源顶尖水平,为开源社区提供强大研究基座。

AIGC开放社区
新闻资讯8

刚刚,GPT-5 横扫编程奥林匹克,5 小时打穿 12 题!人类最强队伍只能做出11道

2025年国际大学编程竞赛世界总决赛(ICPC)上,GPT - 5和OpenAI实验推理模型5小时解完12道题,越人类最强队伍。Google DeepMind的Gemini 2.5 Deep Think获10/12。此成绩展示推理系统惊人进步。

AI进修生