统一建模框架」共找到 2147 篇相关文章

开源动态7

1.9K Star 谷歌开源MCP Toolbox,支持langchain、llamaindex、各类数据库

谷歌开源MCP Toolbox获1.9K Star,支持langchain、llamaindex和各类数据库。它位于应用编排框架间,能简化数据库配置等,可用自然语言交互,还给出python调用方法。

CourseAI
产品应用7

全新唇同步技术OmniSync,遮挡,侧脸不在话下

唇同步对创建逼真视频内容很重要,但现有方法在身份一致、姿势变化等方面有局限。中国人大携手快手提出OmniSync,引入无需掩膜的训练范式,保证身份和姿态一致,能适应复杂场景,还建立AIGC - LipSync基准。

带你学AI
算法论文8

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

ClawBench让AI在144个真实网站执行153个日常任务,结果惨烈,如Claude Sonnet 4.6每三任务翻车两个,GPT - 5.4仅完成10个。它还揭示AI在真实环境的问题,为评估模型提供标尺。

机器之心
算法论文8

夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。

新智元
推荐文章7

Mastra 还是 LangGraph.js?选型先看三条断层线

2026 年上半年,TypeScript 团队做 AI Agent 常面临 Mastra 和 LangGraph.js 选型难题。二者功能清单趋同,但工程哲学不同。文章从语言原生与跨语言移植、缩到零的 serverless 与常驻的持久化、完整工具箱与自由原语三条断层线分析选型依据。

AI Reading Hub
算法论文8

科研数据不再碎片化!一张可计算图,连起整个科研世界

UIUC研究团队打造ResearchArcade,将ArXiv论文、OpenReview评审等碎片数据连接成动态知识图谱。它有多源、多模态等特征,支持多种格式数据导入导出,定义了六个任务,验证了图结构在科研数据处理中的作用。

新智元
开源动态8

视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆

2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。

机器之心
算法论文7

让大模型指哪打哪的Multi-Agent路由新范式

随着MCP生态兴起,一个Assistant背后可能挂数百工具/子Agent,传统检索方式有成本高、埋没工具等问题。作者提出Tool-to-Agent Retrieval新范式,实验显示指标全面提升,证明工具细节能补足语义。

PaperAgent
产品应用8

智源悟界 · Emu3.5 重塑世界模型格局:首提多模态 Scaling 范式,AI 理解世界再进化

北京智源研究院发布大规模多模态世界模型“悟界·Emu3.5”,它能模拟复杂动态物理世界,揭示“多模态Scaling范式”。该模型继承深化Emu3技术哲学,在多方面有提升,为世界模型领域提供进化路线。

AI科技评论
开源动态8

Meta 新成立超级智能实验室,让大模型RAG推理速度飙升30倍

Meta新成立超级智能实验室(MSL),首篇论文REFRAG将RAG推理速度提升30倍以上。它先把上下文压缩成摘要再解码,减少计算量和延迟,在多任务测试中表现出色,为大模型部署提供实用方案。

AIGC开放社区