自适应推理框架」共找到 3380 篇相关文章

算法论文8

轻量高效,即插即用:Video-RAG为长视频理解带来新范式

现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。

机器之心
开源动态8

34k star!开源多层级自主协作AI Agent,超10万开发者认证

CrewAI是超34000颗星的开源AI Agent框架,曾获Github每日增长趋势第一。基于Python,核心架构由CrewAI Crews和CrewAI Flows组成,设计灵感源于人类协作,已有超10万开发者认证。

AIGC开放社区
算法论文7

支持5000+ Server,ScaleMCP为大模型Agents动态同步MCP工具

现有工具选择框架未整合MCP服务器,存在重复、不一致和低效问题。普华永道提出ScaleMCP,配备MCP工具检索器,还提出TDWA嵌入策略,通过实验证明其提升了LLM代理性能。

PaperAgent
新闻资讯7

AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退

Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。

新智元
算法论文8

DeepMind新论文炸锅:AI全自动进化算法,写出专家都想不到的解,网友:这可能就是“王牌”

谷歌DeepMind让LLM驱动的智能体AlphaEvolve改写、进化算法代码。选定CFR、PSRO框架,只开放关键决策逻辑给LLM,通过生成、运行、评估、筛选循环,进化出VAD - CFR和SHOR - PSRO算法,表现超人类手工版本。

InfoQ
开源动态8

华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了

华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。

量子位
开源动态7

继MCP、A2A协议之后,又一个Agent协议AG-UI来了

AI Agent交互协议不断演进,在MCP、A2A协议后,copilotkit发起AG - UI项目,构建开放、轻量级、基于事件的Agent - 用户交互标准化协议,侧重前端交互,已获部分框架兼容。

AI工程化
算法论文8

夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。

新智元
算法论文8

用3D几何先验驱动视频扩散,实现更一致的世界生成

视频扩散模型生成新视角视频时,现有方法缺显式3D结构。智象未来提出DreamWorld,用3D先验与两阶段框架,结合结构和生成能力,在多基准测试表现领先。

机器之心
开源动态8

创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型

开源多模态生成领域获架构级底层突破。上海创智学院与 Sand.ai 联合研发的 daVinci - MagiHuman 正式开源,打破开源界音视频联合同步生成三重局限。它采用单流 Transformer 架构,能力强、推理效率高。

机器之心