音频超分模型」共找到 8800 篇相关文章

推荐文章7

轻量级Multi-agent,可独立用于生产,也可扩展LangChain、CrewAI、Agno

越来越多AI玩家加入Multi - agent领域,现有框架复杂冗长。本次分享可用于生产的轻量级Multi - agent Water,它不依赖任何框架,还能扩展LangChain等,文中介绍其核心组成与上手教程。

CourseAI
算法论文8

打破视觉Token的算力诅咒,RedundancyLens如何为多模态大模型推理减负

多模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于多场景。

PaperAgent
产品应用7

李飞飞World Labs双模齐发,能「造」复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
产品应用8

全球最强AI音乐模型,现在来自中国!高晓松也来围观了

昆仑天工发布音乐模型Mureka V8,实测打败硅谷Suno V5成世界第一。它能生成完整可发布歌曲,结合MusiCoT技术实现从“能生成”到“能发布”跨越。高晓松等认可其变革潜力,昆仑天工联合太合音乐打通产业链。

量子位
产品应用8

小红书提出社交大模型RedOne 2.0:兼听、敏行

在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。

量子位
开源动态8

告别Transformer,重塑机器学习范式:上海交大首个「类人脑」大模型诞生

上海交通大学团队发布首个「类人脑」大模型 BriLLM,脱离传统 Transformer 架构限制。它基于 SiFu 学习机制,有可解释性、能无限处理上下文等优势,还支持多模态融合,已获交大重点项目资助。

机器之心
产品应用7

实测Claude Opus 4.7,好好的模型也开始不说人话了。

作者实测Claude Opus 4.7,它已全渠道上线,价格不变。该模型有多处更新,如隐形涨价、视觉能力提升、审美进步,但也出现不说人话的问题,还新增了effort档位、/ultrareview命令和Cyber Verification Program。

数字生命卡兹克
推荐文章7

《动手写AI Agent》多模型适配:一套代码跑通三家 LLM

上一章用火山引擎豆包 API 写了能跑的 Agent,但换模型重写代码会混乱。本章用 Adapter 模式解决问题,介绍火山引擎、Claude、OpenAI 三家 API 关键差异,还分析了 Claude 工具调用格式特殊之处。

AI Reading Hub
产品应用7

AI大模型重塑学习硬件:从工具到伙伴 | 网易有道孟旭

在 AICon 全球人工智能开发与应用大会·上海站(2025)现场,网易有道孟旭以有道 AI 答疑笔为例,分享智能学习硬件变革逻辑,指出其进化是用户需求、硬件创新与 AI 技术螺旋推进,还探讨大模型应用及未来方向。

InfoQ
新闻资讯8

重大技术突破!微软发布BioEmu模型,蛋白质模拟从数年压缩至几小时

今天凌晨,微软CEO分享蛋白质模拟模型BioEmu,可将蛋白质动态模拟从数年缩至几小时,已在《自然》发表。它能解决传统方法难题,核心设计独特,训练整合多数据源、采用多阶段策略。

AIGC开放社区