数据集构建」共找到 4048 篇相关文章

算法论文8

ICLR 2026 Oral|多模态知识图谱对齐难:破解噪声关联至为关键

数据多元化时代,多模态知识图谱能为下游应用提供数据支撑,实体对齐是构建知识图谱的核心技术。但大规模知识图谱关联与融合面临噪声和潜隐关联挑战。四川大学团队提出 RULE 方法,缓解了这些影响,论文被 ICLR 2026 接收为 Oral。

机器之心
推荐文章7

AI产业链投资大逻辑:第六

聚焦AI产业链应用层悖论。应用层离用户近、故事性感,但现阶段易让投资者犯错。虽有诸多火热产品且公司估值高,但‘创造价值’与投资者‘以好价格买价值’并非一回事。

newtype AI
开源动态8

谷歌开源非结构化数据抽取工具

谷歌开源 Python 库 LangExtract,用 LLM 从非结构化文本文档提取结构化信息。它定位精确、输出可靠,针对长文档优化,有交互式可视化,支持多模型,适应多领域,还给出快速开始示例。

GitHubStore
推荐文章7

别再构建多智能体了

Multi Agent应用有望成大模型应用范式,但Cognition AI团队认为2025年追求多智能体并行协作架构是歧途,存在信息孤岛和决策冲突问题。主张采用单线程线性架构与上下文工程。

AI工程化
开源动态7

开源如何促进平台构建过程中的协作

在KubeCon & CloudNativeCon欧洲大会上,Marcy Paramonova和Stéphane Cusin发表演讲指出平台是协作系统,需共同标准。开源提供共享标准与统一语言,还谈到赢得信任、文化转变等方面举措。

InfoQ
产品应用7

Subagents:构建高可靠 AI Coding 专家顾问团

文章探讨 Claude Code 的 Subagents 功能在复杂 AI 编程场景的价值与实践。指出复杂 AI Coding 面临上下文膨胀等问题,而 Subagents 可创建专属子代理,有 Context 保护等优点,还介绍使用方法、业务实践及相关思考。

阿里云开发者
新闻资讯7

Cloudflare 构建了面向 LLM 的高性能基础设施

Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。

InfoQ
新闻资讯8

云栖重磅合 | 吴泳铭:超级人工智能之路

2025云栖大会上,阿里巴巴团CEO吴泳铭认为实现AGI是确定事件,终极目标是超级人工智能ASI。他介绍了通往ASI的三阶段,还判断大模型是下一代操作系统,超级AI云是下一代计算机。阿里云也升级全栈AI体系,通义大模型7连发。

阿里云开发者
推荐文章7

AI Agent的上下文工程:构建Manus的经验教训

上下文工程是AI智能体的“系统一”,决定其速度、恢复力与扩展边界。Manus通过试错与用户验证,给出可复用经验,如利用大模型“上下文学习”能力、关注KV - cache命中率等。

PaperAgent
新闻资讯7

AI重新打开了创业窗口期?数据告诉你真相

移动互联网红利结束后创业圈寒冬漫长,2025 年起 AI 创业融资回暖,但资金中于头部公司。AI 使创业成本断崖式下降,一人公司兴起,不过 AI 创业失败率仍高。真正的创业窗口期属于有行业认知、能差异化定位且善用 AI 的人。

AI Reading Hub