---
myst:
  html_meta:
    "moi:status": "paper-verified"
---

# 数据目录

平台中的每一份数据都在目录中登记：有明确的归属，有来源与去向的记录。AI 检索数据之前，经由这里定位数据；您追查一个答案的出处时，沿这里的记录回溯。

| 您的数据 | AI 的参与 |
|---|---|
| 每份数据登记归属（工作区 → 目录 → 数据库 → 表 / 文件卷），来源与去向随加工、使用被记录 | AI 检索前经由目录定位数据；答案的溯源沿这里的记录回查 |

## 数据的归属层级

| 层级 | 说明 |
|---|---|
| 工作区（Workspace） | 资源与权限的隔离边界；成员、数据与费用都以工作区为单位 |
| 目录（Catalog） | 工作区内组织数据资产的顶层单位 |
| 数据库（Database） | 目录下的分组，容纳表与文件卷 |
| 表（Table） | 结构化数据，真实存在于 MatrixOne 数据引擎 |
| 文件卷（Volume）与文件 | 非结构化文件的管理单位；文件内容存储于对象存储，文件卷登记名称、位置与状态 |

表与文件卷的差别值得注意：**表的数据在数据库引擎中，文件的内容在对象存储中**。目录对两者的登记方式一致，但物理位置不同——这决定了加工时的规则：工作流传递文件引用，而非文件内容（见[数据加工](processing.md)）。

## 登记之外：来源与去向

目录不只记录「有什么」，还记录「从哪来、到哪去」：

- **数据血缘**。加工产物与源文件的对应关系在加工完成时登记。知识库中的任何文本块，都可以回溯到它出自哪份文件。
- **消费记录**。数据被哪个知识库使用、被哪次问答引用，沿血缘可查。[知识库](../ai/knowledge-base.md)问答的「答案可溯源」，依据即在此。

## 使用限制

- 绕过平台直接在 MatrixOne 中修改库表后，目录的登记与实际状态可能不一致；执行元数据同步后对齐。

## 下一步

| 您想做的事 | 前往 |
|---|---|
| 把已登记的原始文件加工为可检索数据 | [数据加工](processing.md) |
| 查各术语的确切定义 | [名词对照](../reference/glossary.md) |

> 面向 AI 代理的说明：定位数据时以目录登记为准；表真实存在于 MatrixOne，文件内容存储于对象存储；「元数据同步」用于修复绕过平台操作造成的登记偏差。
