AI模型性能」共找到 13755 篇相关文章

算法论文7

架构解耦是统一多模态模型所必须的吗?全新AIA损失:No

香港中文大学 MMLab 和美团研究者思考架构解耦是否为统一多模态模型必须,推出 AIA 损失。研究发现架构解耦未解决任务冲突,AIA 能提升模型性能,减少数据配比问题。

机器之心
算法论文8

双榜SOTA!微软ACL2026新作重新定义AI长记忆

大语言模型落地中,AI长期记忆能力成瓶颈,传统RAG方案有局限。微软研究团队提出AI记忆框架Mnemis,受认识论与认知科学启发,在两大权威长期记忆基准达SOTA性能,工作被ACL2026主会议接收。

量子位
新闻资讯7

国产开源模型越多,模型路由的机会越大

中国大模型市场模型增多,能力相近、价格降低且部分开源。开发者选择多但企业选模型难,价值向调度层转移。开源改变产业结构,Routing业务有价值且至少含四层,中国Provider Routing易落地。

newtype AI
产品应用8

全球最强AI音乐模型,现在来自中国!高晓松也来围观了

昆仑天工发布音乐模型Mureka V8,实测打败硅谷Suno V5成世界第一。它能生成完整可发布歌曲,结合MusiCoT技术实现从“能生成”到“能发布”跨越。高晓松等认可其变革潜力,昆仑天工联合太合音乐打通产业链。

量子位
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发新模型

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。

AI前线
算法论文7

何恺明改进了谢赛宁的REPA:极大简化但性能依旧强悍

扩散生成模型在建模复杂数据分布表现出色,但与表征学习领域关联不大。谢赛宁团队提出REPA,不过较麻烦。何恺明团队提出Dispersive Loss,简化且性能强,无需预训练等,适用于多种模型

机器之心
新闻资讯7

ICLR 2026北京论文分享会启动,直击「AI龙虾」、世界模型新范式

2026 年人工智能领域,「龙虾」(OpenClaw)私人 Agent 助理成人机交互标杆,世界模型受关注。ICLR 2026 4 月将在巴西举行,机器之心 4 月 18 日在北京举办论文分享会,邀大家参与交流。

机器之心
产品应用8

“这半年,我也用AI救了6条活生生的命啊。”

本文讲述作者用AI对抗癌症的经历,介绍阿里达摩院发布的胃癌早筛模型GRAPE和胰腺癌早筛模型PANDA。作者亲身体验PANDA筛查流程,医生业余投入项目,半年额外发现6个早期患者,令人感动。

数字生命卡兹克
产品应用7

AI从云端“下沉”,Arm如何赋能端侧

端侧AI发展近十年,已进入应用快速拓展期,成为推动消费电子革新重要力量,但面临视觉处理、内存平衡和应用迭代等挑战。Arm推出相关平台与技术,如SME2,提升AI性能与能效,还与厂商合作,持续创新赋能端侧。

芯师爷
新闻资讯8

医疗AI十年,终于有人跑通了最难的一关|甲子光年

2026年5月20日,德适AI AutoVision®染色体核型辅助诊断软件获国家药监局第三类医疗器械注册证。这验证了iMedImage®基座模型产出产品可通过最高等级监管审查,为医疗AI产业化提供了可行路径。

甲子光年