「多模态智能硬件」共找到 4422 篇相关文章
DeepSeek研究员1200行代码复刻vLLM,H800硬件实测性能反超原版
DeepSeek研究员俞星凯搞出开源项目Nano - vLLM,仅用不到1200行代码实现最小化且完全可读的vLLM。它有快速离线推理、代码可读性强、含优化套件等特点,在H800硬件实测中性能反超原版vLLM。
具身智能体操作系统PhyAgentOS,赋能全球Physical AI 技术挑战赛冠军
2026年4月27日,中山大学HCP实验室研发的PhyAgentOS开源框架,助力11岁开发者Arjun获全球Physical AI技术挑战赛冠军。该框架降低开发门槛,打通执行闭环,加速具身智能落地。
字节前技术负责人创业,联手清华姚班校友,编程智能体世界登顶
词元无限团队开发的编码智能体 InfCode,在权威 AI Coding 基准中登顶。它定义 AI 编程「工程时代」,有代码意图分析等亮点,背后是豪华团队,致力于构建商业闭环。
人大高瓴-华为诺亚:大语言模型智能体记忆机制的系列研究
中国人民大学高瓴人工智能学院与华为诺亚方舟实验室聚焦大语言模型智能体记忆能力,形成含综述论文、数据集和工具包的研究体系。探讨记忆概念、重要性、实现与评测方法,还构建评测榜单、实现工具包。
进攻是最好的防守:超级平台为何「不得不」对AI智能体出手?
上海交通大学团队提出,超级平台“必须”攻击AI智能体,以守住其作为数字流量守门人的地位。研究从守门人理论分析反击原因,还阐述平台应对策略、攻击策略特点约束,最后强调要推动建设性技术治理生态。
八年研究沉淀,原方智能试图让机器拥有关于世界的「信念」
原方智能正式启动,由林浩鑫与唐开强创立,技术源于 LAMDA 团队八年研究。其目标是使机器在物理世界形成对世界的'信念',以世界模型为核心技术路线,将研究成果推向开放物理世界。
多模态长文本理解测评首发:46款模型无一攻克128K难关
香港科大等研究者联合提出MMLongBench,用于评估多模态模型长文本理解能力。它覆盖5大类型任务的16个数据集,对46个模型测试显示,闭源和开源模型在长上下文任务均面临挑战,OCR和跨模态检索能力是瓶颈。
击败GPT、Gemini,复旦×创智孵化创业团队「模思智能」,语音模型上新了
近日,由复旦邱锡鹏担任首席科学家的模思智能发布多说话人自动语音识别模型 MOSS - Transcribe - Diarize,性能超 GPT - 4o、Gemini 等。它解决语音领域落地痛点,跑分亮眼,还解决 SATS 方案不足,开放 API 限时免费。
ICLR 2026 Oral|多模态知识图谱对齐难:破解噪声关联至为关键
在数据多元化时代,多模态知识图谱能为下游应用提供数据支撑,实体对齐是构建知识图谱的核心技术。但大规模知识图谱关联与融合面临噪声和潜隐关联挑战。四川大学团队提出 RULE 方法,缓解了这些影响,论文被 ICLR 2026 接收为 Oral。
AI竟会「自己认错」?破解多智能体协作「罗生门」,斩获ICML 2025 Spotlight
多智能体AI系统任务失败后,开发者常难定位问题。PSU、杜克大学与谷歌DeepMind等机构提出「自动化失败归因」,发布Who&When数据集,探索三种归因方法,虽目前效果欠佳,但为打造可靠系统提供方向。