「多模型协同」共找到 9993 篇相关文章

算法论文8

告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代

大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。

深度学习自然语言处理
开源动态8

阿里开源 Wan2.2-Animate!统一角色动画和视频人物替换

阿里通义实验室开源 Wan - Animate,这是用于角色动画与替换的统一框架。它构建于 Wan 模型之上,支持角色动画和角色替换两项核心功能,性能超现有算法,还通过独特设计实现多种效果。

带你学AI
开源动态8

蛋白质基座的GPT时代来了?!

清华大学周浩课题组联合上海人工智能实验室发布蛋白质基座模型AMix - 1,以系统化方法论构建,实现蛋白质基座领域从BERT到GPT时代跨越,有四大‘超能力’,设计的蛋白活性提升50倍,代码等已公开。

量子位
产品应用8

微软深夜发布SambaY架构,Phi-4min加速10倍推理

微软基于Phi-4-mini版本,针对特定推理任务微调出Phi-4-mini-Flash-Reasoning 3B模型,将其扩展到200064 tokens。采用新型SambaY架构,支持64K token上下文长度,运行快10倍,有诸多优点。

PaperAgent
新闻资讯8

新紫光集团三周年:智变跃升,交出硬核答卷

2025年7月11日新紫光集团完成战略重整三周年,交出硬核答卷,连续三年营收超千亿,专利增加。其聚焦智能科技主业,通过战略布局、技术攻坚、生态协同实现发展,未来将持续求新求变,深化合作。

芯师爷
开源动态7

AI还不会独自问诊,o3准确率仅为51.12%,上交大×SII开源高难度复杂疾病诊断测评集

上海交大与SII团队开源高难度复杂疾病诊断测评集DiagnosisArena。测试显示,现有大模型在复杂临床诊断任务中表现不佳,o3准确率仅51.12%,且选择题设置无法反映其真实能力。

量子位
新闻资讯8

代码生成越来越快,软件交付真正的瓶颈转向了哪里?

本文整理了2026云栖大会AI Native研发实践论坛的嘉宾分享,围绕代码生成提速后软件交付的新瓶颈问题,展示了阿里各业务线与学界的最新实践,探讨AI Native研发新方向。

机器之心
新闻资讯8

一个「流浪」数学家的遗产,正在被AI公司疯抢

2026年,OpenAI等公司用AI解决多个匈牙利数学家Paul Erdős提出的问题,震动数学界。这些问题分布广、难度跨度大,适合模型测试。不过,AI证明的验证和人类数学家地位受关注。

机器之心
产品应用7

马斯克4000亿布局Agent :杀死 Cursor,Bot 有什么绝招?

马斯克花600亿美金买下AI编程产品Cursor俩月后,SpaceXAI发布Grok Bot。它定位特殊、可跨应用操作等,亮点是多智能体云端协作,但产品力与生态有差距,定价高端。

鲸选AI
产品应用7

龙虾更新出了大bug,12小时内紧急发新版

龙虾火速更新到OpenClaw 2026.3.23版本,距3.22版本仅12小时。此次更新光速修复UI崩溃,接入DeepSeek和Qwen家族,完善插件API兼容性,还在UI、模型、安全等方面有改进。

量子位