多LLM系统」共找到 5917 篇相关文章

产品应用8

比10年专业医生准4倍!微软发布突破性医疗AI系统

微软首席执行官分享新发布的医疗AI系统MAI - DxO,它模型无关,能适配不同语言模型,模拟医生诊断流程。测试显示其准确率远超专业医生,成本大幅下降。此外还发布序贯诊断基准SDBench。

AIGC开放社区
产品应用8

每一幕皆可控!字节发布主体视频生成神器,人人皆主角

字节发布主体视频生成神器MAGREF,基于一张参考图像,能生成主体高度一致的视频,人同台也不串脸。它采用三阶段数据处理流程,构建在DiT架构上,实现复杂视频生成任务。

量子位
算法论文8

Agentic RL训练:它不是单一 RL 算 法,而是一整套环境建模、学习信号、异步数据流、策略优化和基础设施的协同系统

文章指出Agentic RL训练不是单一算法,而是协同系统。它与传统RL不同,有四个训练变化。理解它要围绕三个不变量,还从环境建模等八个方面阐述,强调其竞争在于环境、信号、分布与系统的协同闭环。

深度学习自然语言处理
开源动态7

Meta把内部设计系统开源了,支撑内部13000+应用,专为Agent调优

Meta开源的Astryx大更新,改造成Agent适配设计系统。它已在Meta内部演进8年,支撑13000+应用,提供150+可访问、可主题化的UI组件及开发工具,让人和AI用同一套语言。

开源AI项目落地
开源动态8

国产LLM又迎来一波开源潮:Qwen、华为盘古、腾讯混元、小米~

本周国产开源LLM集中爆发,Qwen、华为盘古、腾讯混元、小米等接连发布模型。如Qwen3 - 4B性能提升,Qwen - Image文生图能力强;华为开源盘古模型并宣布CANN开源;腾讯混元小尺寸模型特点且已落地业务。

PaperAgent
产品应用8

揭秘!腾讯如何训练智能体像专家一样设计游戏场景

腾讯游戏提出游戏场景自动布局生成系统IntelliScene 2.0,利用图像引导生成3D场景。它构建智能体工作流,结合高质量数据集,经模型微调、视觉解析等步骤生成场景,经评估效果良好,为AI生成三维信息提供新路径。

腾讯技术工程
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营
算法论文8

豆包是如何炼成的?字节放出自研万卡训练系统ByteRobust论文

文章介绍字节跳动的LLM训练基础设施ByteRobust。它由控制和数据平面构成,关键目标是获高ETTR。该系统优先快速隔离故障、考量人为错误、控制恢复可变性,已部署超一年,效果显著。

机器之心
算法论文8

基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结

近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。

深度学习自然语言处理
算法论文8

大模型长脑子了?研究发现LLM中层会自发模拟人脑进化

帝国理工学院等机构研究人员发表论文,指出大型语言模型(LLM)学习中会自发演化出类似生物大脑的协同核心结构。研究对个模型剖析,揭示其内部处理规律,为大模型可解释性开辟新路径。

机器之心