「半监督评测体系」共找到 1306 篇相关文章
清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源
清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。
NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则
文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态大模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。
清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超分新范式
音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高分辨率音频生成潜力。
CAIR开源发布超声基座大模型EchoCare“聆音”,10余项医学任务性能登顶
2025年9月17日,CAIR开源发布超声基座大模型EchoCare“聆音”。它基于超450万张影像数据集训练,在10余项医学任务测试中表现卓越。首创结构化对比自监督学习框架,为AI医疗应用提供创新路径。
告别海量标注!浙大团队提出GUI-RCPO,让GUI定位在无标签数据上自我进化
浙大等机构研究人员提出GUI - RCPO,这是自我监督强化学习方法,能让模型在无标注数据上提升GUI grounding能力。其通过迁移思想,利用区域一致性自我提升,实验表明该方法有效且有泛化能力。
AI 基础设施缺失的一层:聚合代理流量
在 AI 融入应用热潮中,代理流量爆发成 AI 基础设施缺失层。传统设施难管理,致成本、安全等问题。Gartner 关注此差距,‘AI 网关’成新兴类别,它补充现有设施,助组织重获代理流量监督。
Sora没做到的,LongVie框架给解决了,超长视频生成SOTA
视频生成近年进步大,但生成超1分钟高质量长视频仍难。上海人工智能实验室等机构提出LongVie框架,解决时序不一致和视觉退化问题,还推出评测基准LongVGenBench,该框架在多项指标达SOTA。
美国专家来中国转了一圈:AI比赛已经结束了
美国专家Rui Ma参观中国AI相关活动后称,中国AI企业实力强,能源问题已解决,大规模投资可持续能源,有安全低成本电力供应体系,而美国电网老化、审批慢、储备少,AI竞赛或已结束。
欢迎 GPT OSS —— 来自 OpenAI 的全新开放模型家族!
OpenAI推出GPT OSS开放模型家族,含117B参数的gpt‑oss‑120b和21B参数的gpt‑oss‑20b。采用Apache 2.0许可证,资源占用低、推理快,适多场景,已接入Hugging Face服务,还介绍了推理、部署等内容。
直击WAIC:萝卜快跑入选「国家队」,AI数字人技术升级,百度全栈自研杀疯了
在世界人工智能大会 WAIC 上,百度成果亮眼。萝卜快跑入选「国家队」,出海进展快,还与 Uber 合作;数字人技术升级,发布 NOVA。百度靠全栈自研技术体系支撑,目标是打造数百万个超级应用。