「多模型 Agent」共找到 10765 篇相关文章
GitHub上已突破5.1k stars!这是真正被开发者认可的 AI Agent平台,AI开发者必看,如何用它实现生产力逆袭?
TaskingAI是AI - native应用开发平台,整合多模块提供一站式BaaS体验,简化AI应用全流程。它支持多模型,有检索、工具插件等功能,适用于客服、销售等场景,还对比同类项目展现优势。
告别单一大模型依赖!北航等机构发布综述:大语言模型集成(LLM Ensemble)
北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三大集成范式。
五一我没开电脑,但我的 Agent 团队没放假 | 如何用Hermes Agent移动办公
作者五一旅行未开电脑,但工作未停,靠Hermes Agent移动办公。介绍了其基本链路,还将Agent分工,如个人助理、内容总监等,也提到多Agent群聊协作,最后指出一人公司用Agent需明确流程、完善知识库,人要做好判断。
Ollama升级模型调度系统:内存管理更精准,多GPU性能提升
Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。
AI制造AI、仓库级Coding到Agent底座:2026奇点智能技术大会首批议题公布
2026 奇点智能技术大会将于 11 月 20 - 21 日在北京举行,同期还有 C++ 及系统软件技术大会。大会公布首批核心议题,涵盖 AI 制造 AI、AI Coding、Agent 基础设施、世界模型、具身智能等前沿技术,多位专家将分享实践经验。
大模型时代,通用视觉模型将何去何从?
过去通用视觉模型(VGM)是研究热点,想实现‘视觉模型大一统’。但大语言模型发展使研究热点转移,视觉‘独立性’被重新定义。清华鲁继文团队综述梳理其进展,探讨现状、挑战与应用潜力。
32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1
2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。
NVIDIA 开源 Live VLM WebUI:摄像头实时测试视觉语言模型
NVIDIA 开源 Live VLM WebUI,可让用户在本地用摄像头实时测试视觉语言模型。它基于 WebRTC 技术,能将摄像头视频流实时传输给模型,分析结果叠加在画面上,支持多后端、多平台及多种模型。
大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱
CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。