多模型策略」共找到 9909 篇相关文章

开源动态8

拒绝传统 Router“瞎指挥”,智能体如何实现智能任务分配?

企业级智能体系统瓶颈常是负责分发任务的传统 Router 太“傻”,搞不定跨域、解不了冲突、跟不上变化。腾讯云开源 TCAR 智能路由模型,它先推理再选 Agent 集合,经数据集评测表现出色,还提供完整开源范式。

InfoQ
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心个角色吵翻了

谷歌等机构研究指出,推理模型能力提升源于‘思维社会’,即模拟类智能体交互结构。如 DeepSeek - R1 等在推理中展现高视角样性,对话特征能提升推理准确率,还提出利用‘群体智慧’新方向。

机器之心
产品应用8

360发布全球最强视觉语言对齐模型!榜单全面领先!

360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文模态评测基准。

AIGC开放社区
产品应用7

快手提出强化学习创新框架RLEP,突破大模型推理瓶颈

OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升大模型训练效率和性能。

AIGC开放社区
新闻资讯7

模型热度退潮,真正的技术创新者开始被「看见」

过去两年中国大模型投资是商业模式驱动,而技术投资注重创新。DeepSeek 出圈后,独立创新成主流。今年国内大模型吸金热度下降,但智谱 AI、面壁智能仍获融资。面壁智能发布 MiniCPM 4.0,在方面优化,展现端侧优势。

AI科技评论
推荐文章8

游戏研发中的 AI 转型:网易 Agent 系统与知识工程实践

本文整理自网易游戏高级技术经理林香鑫分享,介绍大模型在游戏研发落地实践。团队用代码知识谱图、 agent RAG 召回等技术打造超级助手,在业务场景落地,推动内部 AI 生成代码覆盖率提升。

InfoQ
开源动态8

BigBang-Proton: 自回归基座模型统一语言、科学和物质世界

超对称公司发布新版基座模型 BigBang - Proton,实现学科问题与 LLM 统一预训练和推理,挑战主流 AGI 技术路线。它有三项创新,在专业学科任务表现出色,还提出宇宙尺度压缩构想。

InfoQ
开源动态8

清华团队开源发布首个结构化数据通用大模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用大模型。它融合结构因果推断与预训练技术,适配任务,性能超最优专用模型,已落地个工业场景。

AI科技评论
开源动态8

Claude团队打开大模型「脑回路」,开源LLM思维可视化工具来了

Claude团队推出“电路追踪”工具,可生成归因图呈现LLM处理信息路径,支持在主流开源权重模型上快速生成。研究人员能借此解码LLM“决策逻辑”,官方还给出语言电路等示例。

量子位
开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!

当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。

MCP Server