「多智能体大语言模型」共找到 9615 篇相关文章
Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO
Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。
NVIDIA发布最强开源模型,效果和速度全面超越DeepSeek R1
NVIDIA推出Llama - Nemotron系列开源模型,有LN - Nano、LN - Super、LN - Ultra三款。旗舰款LN - Ultra在权威测评中碾压DeepSeek - R1等,运行效率还更高。有“动态推理开关”功能,代码数据全公开,或引发AI推理效率革命。
官宣!前 OpenAI 华人科学家姚顺雨加入腾讯,大模型“系统战”开启!
12月17日消息,前OpenAI科学家姚顺雨加盟腾讯,任首席AI科学家等职。他是AI Agent与大模型推理领军人物,其加入是腾讯AI补强。腾讯还新成立三部门,标志战略向系统化工程建设进阶,混元也有不错表现。
湾大北交大开源 CutClaw,自动踩点音乐的 AI 智能视频剪辑师!
大湾区大学GVC实验室和北京交通大学团队开源CutClaw,它是模拟专业后期流程的多智能体系统,能实现音乐驱动剪辑,按文字指令自动剪辑,适配多平台,还可解构素材。操作简单,支持多模型。
打破视觉Token的算力诅咒,RedundancyLens如何为多模态大模型推理减负
多模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于多场景。
OpenClaw大更新,AI智能体不再是黑箱!官方口号:少点神秘
4月25日,OpenClaw发布v2026.4.25版本,官方口号“Less mystery, more machinery”。此次更新核心指向AI智能体下半场要更透明、可控,涵盖语音、可观测性、插件启动等多方面改进。
全球最强AI音乐模型,现在来自中国!高晓松也来围观了
昆仑天工发布音乐模型Mureka V8,实测打败硅谷Suno V5成世界第一。它能生成完整可发布歌曲,结合MusiCoT技术实现从“能生成”到“能发布”跨越。高晓松等认可其变革潜力,昆仑天工联合太合音乐打通产业链。
小冰之父李笛智能体创业,公司取名Nextie!陆奇是股东
12月7日陆奇2025秋季「奇绩创坛路演日」,李笛压轴登场公开新创业公司明日新程(Nextie)。新团队由小冰核心初创团队构成,正计划启动千万美元融资,陆奇旗下奇绩是股东之一。公司想通过群体智能让AI有「认知」,产品预计明年1月7日上线。
小红书提出社交大模型RedOne 2.0:兼听、敏行
在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。
2025年的冬天,上海凭什么被称为“世界具身智能第一战场”?
2025年上海或成“世界具身智能第一战场”。上海构建服务型政府生态,开放场景、平权算力、建设语料、集聚产业。企业完成蜕变,政策催生技术突变,12月12日GDPS大赛将是成果“实弹演习”。