「静态人物图」共找到 409 篇相关文章
面向6G环境感知通信!西电开源3Dx3D无线电地图数据集与生成式基准框架
面向6G,西安电子科技大学等团队联合提出高分辨率多模态三维无线电图谱数据集UrbanRadio3D,构建三维无线电图生成框架RadioDiff-3D,弥补了当前主流RM构建方法与数据集的局限。
不靠Agent,4步修复真Bug!蚂蚁CGM登顶SWE-Bench开源榜
蚂蚁集团代码图模型 CGM 基于开源模型,不靠 Agent 架构,用 4 步轻量级流程完成仓库级代码修复,在 SWE - BenchLite 公开排行榜成绩亮眼,打破闭源垄断,还解决了 LLM + Agent 架构的一些问题。
拆解、对比与优化:LLM工具智能体的五种任务规划与执行模式
文章探讨了大语言模型驱动的AI智能体的五种任务规划与执行模式,包括ReAct、Plan-and-Execute、静态Workflow、Workflow+局部智能、模块化的分层规划,分析其优缺点、适用场景,还给出优化方法。
给Agent加上知识图谱,开源版Palantir
Semantica是LLM、向量库与Agent框架下的语义/上下文层,能把碎片化企业数据变成结构化、可查询的上下文图与知识图谱。介绍了其面向对象、功能、优势、使用方法、架构等内容。
给文档质量"打分":DIQA-5000 数据集与融合版面语义的 DocIQ 质量评估模型
文档图像质量评估(DIQA)是评判‘增强算法有没有把图变好’的关键工具。过去研究多围绕自然图像,缺文档专用数据集。本文提出DIQA - 5000数据集和DocIQ模型,补齐缺口。
离大谱!15k Star book-to-skill,我惊到了!!!
book-to-skill是将书籍、文档目录或多份资料转换成Agent Skill的命令行工具。它把资料拆成可按需加载的知识资产,有按需加载章节等优势,适合将常用知识编译成技能,不过也有一定局限性。
换个地面/身体,机器人策略就失灵?让扩散策略读懂「动力学」| ICML'26
扩散策略成机器人控制热门路线,但真实世界动力学多变,策略易失灵。UC Berkeley等联合提出DADP,训练统一策略,在零样本跨域控制任务表现强,尤其在OOD场景优势明显,还给出工程补充结果。
马斯克破大防了:私信求和遭拒,怒喷奥特曼Brockman「全美最恶人」
马斯克与OpenAI两兄弟庭审进入第二周,马斯克曾发短信提议和解遭拒后破防威胁。短信虽未作庭审证据,但舆论偏向OpenAI,其胜诉率下降。Brockman出庭承认报酬是次要动机,双方各亮手牌,后续奥特曼等将出庭。
探索 GPU 加速向量检索:NVDIA Cagra 在微信大规模推荐系统中的应用实践
本文分享腾讯团队将 Cagra GPU 图索引大规模应用于微信核心线上推荐业务的实践。介绍 Cagra 算法原理与优势,讲述线上化改造、架构演进、CPU/GPU 协同优化等,展示业务落地显著收益。
极客大神构建了LLM架构画廊,AI大神Karpathy点赞
极客大神Sebastian Raschka构建LLM Architecture Gallery,将复杂模型结构化繁为简,引发技术圈讨论,AI大神Karpathy点赞。画廊高度视觉化、互动性强,展示模型架构图及核心参数,源数据开源。