数据难题」共找到 3474 篇相关文章

算法论文7

做RAG这一年,最后悔的就是上知识图谱

基于知识图谱的检索增强生成在问答任务中存在三元组索引丢失上下文语义问题,作者提出MDER - DR双阶段框架,在标准测试和特定数据集上性能提升最高66%,还具备多方面优势。

PaperAgent
推荐文章7

Prompt、Skills、MCP:大模型上下文工程核心链路

文章聚焦大模型上下文工程,介绍了Prompt、Skills、MCP核心链路。Prompt是与模型沟通基础,但其有脆弱、难管等痛点,促使向上下文工程演进;Skills是能力单元,可显式化能力、动态组合;MCP解决能力集成问题,虽有争议但理念重要。

AIGC开放社区
推荐文章8

Agent/Skills/Teams 架构演进过程及技术选型之道

文章结合作者实践与多篇论文,梳理Agent架构从单点提示词调用到Agent Teams的演进逻辑,分析Single Agent、Multi - Agent、Agent Skills、Agent Teams的优劣,给出架构选型建议,强调架构应与问题复杂度匹配。

阿里云开发者
推荐文章8

不要建一千个 Agent:Ramp 如何用一个 Agent 搞定金融自动化

美国企业金融平台 Ramp 估值 320 亿美元,在 The Pragmatic Summit 分享 AI 实战经验。介绍了从“建一堆 Agent”转向“一个 Agent + 一千种技能”架构,Policy Agent 开发过程,定义“正确”标准,建内部 AI 基础设施及内部编码 Agent 情况。

宝玉AI
算法论文8

4B模型幻觉抑制能力超越GPT-5,CMU等提出行为校准强化学习新方法

大语言模型幻觉问题是部署难题,CMU等研究人员提出行为校准强化学习新方法,重新设计奖励函数。经训练,40亿参数模型幻觉抑制力超GPT - 5,实验证明该方法效果显著,还带来理论洞察。

机器之心
产品应用7

Anthropic更新了Skill Creator,评测框架上线

Anthropic更新Skill Creator,上线评测框架。该框架无需写代码,能处理两类技能测试需求,可测试和改进技能,有捕获质量回归等用途。还增加基准模式、多Agent支持等,能让技能触发更可靠,更新已在Claude.ai等可用。

AI工程化
推荐文章8

手把手带你构建第一个业务本体(Ontology):为 Agent 绘制业务地图。

文章介绍为企业AI Agent构建业务本体,阐述Agent需本体的原因,讲解TBox与ABox概念。给出构建流程,介绍RDF/OWL标准及Protégé等工具,实战构建‘订单加急交付’本体并验证,还演示Python程序推理,展望本体应用场景。

AI大模型应用实践
新闻资讯7

效率狂飙数倍后:Coding Agent已然成熟,但开放世界仍是“无人区”

2025 年被定义为 Agent 的‘工程落地元年’。MCP、A2A 协议及多智能体协同框架推动 Agent 应用爆发,但企业级落地仍面临多 Agent 协作低效等挑战。AI Coding 和自动化运维是落地较成熟领域,其终极形态观点不一。

InfoQ
新闻资讯7

ClawdBot,正在引爆全球灾难!各大CEO预警:不要安装,不要安装

一夜爆红的ClawdBot存在端口裸奔、无鉴权、可被远程接管等问题,已引发暴力破解、数据清空等情况。各大CEO预警其将酝酿全球灾难,并给出修复建议和让其更安全的方法。

新智元
新闻资讯8

李飞飞的World Labs联手光轮智能,具身智能进入评测驱动时代!

李飞飞旗下World Labs与光轮智能联手,瞄准具身智能「规模化评测」问题。World Labs的Marble是生产力工具,而光轮智能有自研仿真技术体系,双方合作让规模化评测成为可能,具身智能迈入评测驱动时代。

量子位