「多代理场景」共找到 5488 篇相关文章
阿里、南开大学发布免训练,视频大模型创新压缩方法
视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。
共青年之智,铸AGI未来|2025 WAIC云帆奖得主名单揭晓
2025年7月27日,2025 WAIC云帆奖颁奖典礼在上海举行,公布了「璀璨明星」「明日之星」及提名奖得主名单。活动由多机构联合主办,汇聚产学研资力量,众多知名人士出席颁奖。文章还介绍了各位得主的成就。
ICCV 2025|UV-CoT:无监督视觉推理新突破,偏好优化重塑图像级思维链
随着文本领域思维链推理机制成功应用,研究者将其引入视觉理解任务。现有模型有局限,本文提出UV - CoT新框架,设计无监督数据生成与偏好优化机制,提升模型能力,摆脱对人工标注依赖。
附部署代码|云数据库RDS 全托管 Supabase服务:小白轻松搞定开发AI应用!
本文展示借助 RDS Supabase 搭建 AI 应用的全流程,对比传统开发,其在效率、成本、扩展性上优势显著。介绍 Supabase 特性、适用场景、核心能力,还给出基于它开发简易 Agentic RAG 应用的步骤。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多问题模拟复杂推理场景。结果显示,DeepSeek - R1等模型高压下性能大幅缩水,REST能拉开不同模型差距,还揭示评测方法局限。
5亿融资后清华具身团队首秀:55自由度拿捏360°大旋转,街舞叠衣服都在行,手速堪比电竞选手
这是星动L7机器人秀出的最新能力,打造者是清华叉院背景的星动纪元团队。不久前他们获近5亿新融资,此次新进展惊艳众人,该机器人全身多达55个自由度,创下多项纪录。
Windsurf惊魂96小时!AI闪电并购战:谷歌天价挖人,Cognition逆袭接盘
7月,谷歌以翻倍薪资和24亿美金许可协议挖走Windsurf 40多位顶尖人才。周一,Cognition宣布收购其剩余资产和200来号员工。此前OpenAI收购谈崩,Windsurf还遇模型使用问题。
大模型转行土木工程!首个「打灰人」评估基准:检验读、改工程图纸能力
首个工程自动化任务评估基准DrafterBench,可测试大模型在土木工程图纸修改任务中的表现。它模拟真实工程命令,考察模型四方面能力。评测发现主流大模型有一定能力,但未达工程一线要求。
估值 16 亿美元的 AI 护士:Hippocratic AI 是全球护士短缺的解药吗?
Hippocratic AI 打造 AI Native 医疗劳动力平台,利用市场空白,自研技术架构,交付优质对话体验。其商业模式依赖 AI Agent 自主化,面临经济效益和竞争挑战,也有全球化护理需求等机遇。
打破传统游戏逻辑!Google | 提出Concordia ,通过Mutil-Agent构建游戏引擎!
Google DeepMind和多伦多大学研究人员提出Concordia软件库,用AI驱动智能体担任GM,基于「实体 - 组件」架构,让工程师和设计师分工,可灵活构建复杂游戏场景,还支持不同交互动态和多种使用动机。