将数据源连接到 AI Data Engine
AI Data Engine 扫描您的存储系统以收集和分析元数据。要添加数据源,请完成引导向导。该向导会收集源类型的连接详细信息、扫描范围和设置。添加系统后,激活扫描以开始元数据收集。
-
您必须具有 AI Data Engine administrator 权限才能在 AI Data Engine 中连接和配置数据源。
-
在将存储系统添加到 AI Data Engine 之前,请先使用 Console Agent 在 NetApp Console 中发现这些系统。这适用于所有受支持的存储类型,包括本地 ONTAP 集群、Cloud Volumes ONTAP、Amazon FSx for NetApp ONTAP、Google Cloud NetApp Volumes 和 Azure NetApp Files。对于本地 ONTAP 集群,请参阅 NetApp Console 文档中的 "发现本地 ONTAP 集群"。直接发现不会启用 AI Data Engine 等数据服务。
-
验证 AI Data Engine 访问数据源所需的网络连接是否已开放。请参阅 "AI Data Engine 要求"。
添加数据源
-
从 AI Data Engine UI 中,选择 配置。
-
在*已扫描系统*选项卡上,选择*添加系统*。
-
选择源类型:
源类型 问题描述 文件共享组
从云或本地添加 NFS 或 SMB/CIFS 文件共享作为命名组。
数据库
添加数据库服务器以扫描所选架构。
StorageGRID
使用 S3 协议从 NetApp StorageGRID 扫描数据。
-
输入源类型的连接详细信息:
源类型 必填详细信息 文件共享组
共享组的名称,然后是共享主机和路径详细信息。
数据库
数据库类型、主机、端口和身份验证凭据。
StorageGRID
系统名称、S3 端点 URL 以及 S3 访问密钥和私密密钥。
-
查看您的选择,然后选择 Confirm 以添加数据源。
激活扫描
配置数据源后,扫描不会自动开始。您必须激活每个系统的扫描。
-
从 AI Data Engine UI 中,选择 配置。
-
在*扫描的系统*选项卡上,找到要扫描的系统。
-
选择*激活扫描*。
"已扫描的系统"选项卡中的系统状态将更新,以显示扫描正在运行。要监控扫描进度并验证 AI Data Engine 是否正在索引数据资源,请参阅"管理数据源"和"监控扫描运行状况"。