「多Agent编排」共找到 6082 篇相关文章
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。
告别抽卡、散装工具拼凑!通用AI视频智能体框架UniVA开源
在AI视频创作中,创作者常因频繁切换工具而疲惫。近期多所高校联合开源的UniVA框架,像「AI导演」,能整合视频工具,提供一站式自动化体验,改变「抽卡」式创作,还支持多轮交互等功能。
拆解腾讯智能体战略:自身验证,开放能力,生态放大 | 甲子光年
文章指出智能体成企业战略议题,但落地有场景复杂、知识专业和工程化挑战。腾讯云以全栈方案应对,用开发平台、行业适配和生态共建助力企业,多个行业已有成功落地案例。
SceneSplat: 基于3DGS的场景理解和视觉语言预训练,让3D高斯「听懂人话」的一跃
文章引入 SceneSplat,首个在 3DGS 上原生运行的端到端大规模 3D 室内场景理解方法,提出自监督学习方案,构建发布 SceneSplat - 7K 数据集,在多个实验中达 SOTA 效果。
普通人也能用得上的 Context Engineering 技巧
现在讨论Context Engineering大多关注高级AI Agent,对普通用户实用性不强。本文总结普通人用AI时的上下文工程技巧,如用更少、更准确的上下文控制输出,从精简和准确两方面展开阐述。
全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025
7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务上超越顶尖闭源模型,多模态综合能力领先主流开源模型。
Arch Gateway: AI Gateway的前瞻选择
AI Agent开发易陷入复杂维护困境,借鉴云原生思路,一些云原生产品朝着AI gateway进化。介绍开源项目Arch Gateway,它是AI原生gateway,具备智能路由、工具调用等能力,能让开发者专注核心业务逻辑。
SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻
SGLang 是开源推理引擎,截至 2025 年 6 月,GitHub 近 15K Stars,月均下载量超 10 万次,被多个行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享关键技术等内容,6 月 27 - 28 日他将在 AICon 演讲。
清华开源教育龙虾,沉浸式互动课堂,运行成本仅为传统的千分之一
清华大学团队将校内验证两年的AI课堂系统OpenMAIC开源。它能把主题或文档转化为互动课堂,运行成本仅为传统MOOC的千分之一。有多种组件,多智能体协作,还支持多种大模型,已获学生积极反馈。
音频全能王炸!小米MiMo-Audio开源,力压Gemini/GPT-4o!
小米团队开源通用音频大模型MiMo-Audio,集多种功能于一身,支持7国语言零样本克隆和中英混合合成。首包延迟低,效果自然稳定。在多个基准测试中表现优于Gemini-2.5-Flash和GPT-4o-Audio。