「多模型推理」共找到 10087 篇相关文章
百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流
百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,在昆仑芯P800芯片上训练。该模型多模态能力强,OCR和教育场景表现突出,跑分超国际主流模型。芯片功耗低、架构优,模型训练方法创新。
最强开源Agent!Kimi K2接入Claude Code,爽翻~【喂饭级教程+实测】
上周五Kimi开源最新旗舰模型K2,它是1000B参数MoE大模型,专为Agent场景优化,API已上线且兼容多API。文章给出Kimi - K2接入Claude Code的喂饭级教程及实测,实测显示组合表现有亮点也有不足。
马斯克说漏嘴了!Claude Opus参数5T,Sonnet 1T
马斯克发帖透露xAI的Colossus 2超算训练模型情况,还回应网友时“手滑”泄露Claude的Sonnet 1T、Opus 5T参数。此外,文章梳理网友对Claude各版本参数的推测,也提到Anthropic未发布模型Claude Mythos。
手握30亿、被蚂蚁狂挖人,转型被骂惨的王小川,真的翻身了?
在大模型竞争中,2023 年成立的百川战略收缩聚焦医疗,起初内外存疑。2025 年,AI 医疗技术与应用进展显著,今年初大厂入局。百川如今开源 Baichuan - M3 模型,王小川认为医疗已入应用阶段、多模态非主战场,且国内 To C 更好。
千问Qwen旗舰预览版Qwen3.6-Max-Preview发布
千问Qwen发布下一代旗舰模型早期预览版Qwen3.6 - Max - Preview,在权威评测中登顶最佳国产模型。此前开源的Qwen3.6 - 35B - A3B用30亿激活参数匹敌数百亿参数稠密模型,新模型在多方面给出技术演进方向。
Claude最强领域被GPT反超!GPT 5.5最难编程基准破0
编程领域曾由Claude引领,如今GPT 5.5在大模型解决率为0%的最难编程基准上实现突破。程序重建基准测试(ProgramBench)考验严苛,过往模型解决率为0,GPT 5.5高和超高推理模式成功破局,展现了不同解题风格。
牛津、NUS提出下一代世界模型方向:心智世界模型来了
牛津大学和新加坡国立大学研究团队提出心智世界建模(MWM)通用框架,将心智变量纳入世界状态。还实现基准系统 MENTIS 验证其有效性,实验表明 MWM 对预测人类决策必要,瓶颈是状态转移模拟能力不足。
Kimi K2基于DeepSeek V3构建
从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。
天文预测新SOTA!紫东太初&国家天文台联手攻克恒星耀发难题
紫东太初与中国科学院国家天文台联合开发天文耀发预测大模型FLARE,能精准预测恒星耀发事件。该模型整合恒星物理属性和历史耀发记录,提升预测准确性,相关论文被IJCAI 2025录用。
两岁的Llama,最初的14位作者已跑了11个!Mistral成最大赢家
Meta 开源 Llama 模型改变大模型格局,但短短两年,14 位初创作者 11 人离职。Mistral 受益最大,由两位核心架构师创立,其模型与 Meta 竞争。Meta 面临留才挑战,领先优势消退。