「多智能体强化学习」共找到 4574 篇相关文章
OpenAI「至暗时刻」已至,谷歌一剑封喉奥特曼
昔日盟友倒戈Anthropic,宿敌谷歌技术反超,OpenAI统治地位受威胁。谷歌Gemini 3表现出色,OpenAI技术领先优势缩小,财务也面临压力,但奥特曼表示会推出新模型追赶。
AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型
威斯康星大学麦迪逊分校联合清华的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,使模型在心智理论测试达人类平均水平,揭示构建社交智能AI方法论。
专访丨华人大三学生创业教育 Agent,获赵长鹏 1100 万美元种子轮
硅谷华人大三学生创立的教育类 AI 产品 VideoTutor 完成 1100 万美元种子轮融资,由赵长鹏家办 VC 领投。这是面向 K12 学生的 AI 教育 Agent,能一键生成专属教学视频。文中还探讨了其功能、优势及团队发展规划。
南华期货 x TencentOS:如何实现CentOS操作系统的“无感”切换?
2024年南华期货与腾讯合作,依托TencentOS Server完成200余套操作系统迁移,实现核心业务零事故切换。其分三阶段实施,TencentOS Server以无感迁移、稳定性强、利于生态协同等优势获选,迁移成效显著。
超越Runway!Adobe发布新神器:P视频比P图还简单
Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力。
无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」
清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。
Uber&WisdomAI揭露95%AI Agent落地失败的真相 !
在‘Beyond the Prompt’技术论坛上,Uber、WisdomAI等企业揭开AI智能体落地难症结。指出90%失败源于‘喂错料’,信任是落地‘生死线’,记忆是架构设计,多模型编排与场景化交互决定用户体验上限。
景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态大模型在线时空理解短板
上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战大模型能力。它更贴近真实世界,揭示主流多模态大模型在线时空理解短板,为未来模型发展指明方向。
破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架
大模型参数量飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。
ChatGPT架构师,刚发布了最新研究成果
Thingking Machines发布第三篇研究博客,核心作者是OpenAI联创John Schulman。研究关于LoRA参数高效微调方法,探究其匹配全量微调效率的条件,给出简化调参方案,还提炼出三个核心发现。