「多智能体蒸馏」共找到 6609 篇相关文章
谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?
北京时间5月21日凌晨,谷歌在2025 I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型和2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3,编码助手Jules公测等。
极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning
大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。
ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力
最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。
深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景
大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。
1/8成本比肩Claude 3.7,Mistral Medium 3来了
“欧洲OpenAI”Mistral AI发布多模态新模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。
AI可观测行平台Lightrun,获7000万美元
AI可观测性平台Lightrun获7000万美元B轮融资,由Accel和Insight Partners领投。它改变传统监测工具局限,实现实时调试修复。连续三季成G2领域领导者,获众多企业信赖,发展迅猛。
代码生成越来越快,软件交付真正的瓶颈转向了哪里?
本文整理了2026云栖大会AI Native研发实践论坛的嘉宾分享,围绕代码生成提速后软件交付的新瓶颈问题,展示了阿里各业务线与学界的最新实践,探讨AI Native研发新方向。
“当年在OpenAI像在疯人院!”Jev作者完整访谈:全人类陪AI聊天的价值,不如程序员一个for循环
本文整理了前OpenAI核心研究员、Jev模型创始人Diogo Almeida的完整访谈,Diogo批判当前行业all in聊天大模型的路径偏差,推出专为程序决策设计、不做聊天交互的Jev模型,提出全新RLCD技术范式,倡导AI作为软件底层基础设施赋能自动化生产力。
刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望
本文报道SpaceXAI发布新款大模型Grok 4.7,该模型定位面向编程与知识工作,主打速度翻倍、价格仅为同类一半,强化长任务处理能力,跑分表现引发网友争议。