Skip to main content
NetApp Data Classification
Se proporciona el idioma español mediante traducción automática para su comodidad. En caso de alguna inconsistencia, el inglés precede al español.

FAQ para NetApp Data Classification

Colaboradores netapp-ahibbard

Utiliza esta sección de preguntas frecuentes para encontrar respuestas rápidas a las preguntas más comunes sobre NetApp Data Classification.

Conceptos básicos sobre la clasificación de datos

¿Cómo funciona la clasificación de datos?

La clasificación de datos implementa otra capa de inteligencia artificial junto con tu sistema de NetApp Console y tus sistemas de almacenamiento. Luego analiza los datos en volúmenes, buckets, bases de datos y otras cuentas de almacenamiento, e indexa los conocimientos sobre los datos que encuentra. La clasificación de datos aprovecha tanto la inteligencia artificial como el procesamiento de lenguaje natural, a diferencia de soluciones alternativas que suelen basarse en expresiones regulares y coincidencia de patrones.

La clasificación de datos utiliza IA para ofrecer una comprensión contextual de los datos para una detección y clasificación precisas. Funciona con IA porque está diseñada para los tipos de datos y la escala modernos. También comprende el contexto de los datos para proporcionar una detección y clasificación sólidas y precisas.

¿Data Classification tiene una API REST y funciona con herramientas de terceros?

Sí, Data Classification tiene una API REST para las funciones compatibles con la versión de Data Classification que forma parte de la plataforma central de Console. Ver "Documentación de API" .

¿La clasificación de datos está disponible a través de los mercados en la nube?

La clasificación de datos es parte de las funciones principales de NetApp Console. No necesitas implementar la clasificación de datos desde un marketplace en la nube.

¿Cuánto cuesta la clasificación de datos?

La clasificación de datos es una capacidad central de la NetApp Console . No está cargado

Implementación del agente de consola

Las siguientes preguntas se relacionan con el agente de consola.

¿Qué es el agente de consola?

El agente de consola es un software que se ejecuta en una instancia de cómputo, ya sea dentro de su cuenta en la nube o en sus instalaciones, y que permite que la NetApp Console administre de forma segura los recursos de la nube. Debe implementar un agente de consola para utilizar la clasificación de datos.

¿Dónde se debe instalar el agente de consola?

Al escanear datos, el agente de NetApp Console debe instalarse en las siguientes ubicaciones:

  • Para Cloud Volumes ONTAP en AWS o Amazon FSx para ONTAP: el agente de consola está en AWS.

  • Para Cloud Volumes ONTAP en Azure o en Azure NetApp Files: el agente de consola está en Azure.

  • Para Cloud Volumes ONTAP en GCP: el agente de consola está en GCP.

  • Para sistemas ONTAP locales: el agente de consola está local.

Si tiene datos en estas ubicaciones, es posible que necesite utilizar "varios agentes de consola" .

¿La clasificación de datos requiere acceso a credenciales?

La clasificación de datos por sí sola no recupera las credenciales de almacenamiento. En cambio, se almacenan dentro del agente de la consola.

La clasificación de datos utiliza credenciales del plano de datos, por ejemplo, credenciales CIFS, para montar recursos compartidos antes de escanear.

¿La comunicación entre el servicio y el agente de la consola utiliza HTTP?

Sí, la clasificación de datos se comunica con el agente de la consola mediante HTTP.

Implementación de clasificación de datos

Las siguientes preguntas se relacionan con la instancia de Clasificación de datos independiente.

¿Qué modelos de implementación admite la clasificación de datos?

La NetApp Console te permite analizar y generar informes sobre sistemas prácticamente en cualquier lugar, incluyendo entornos locales, en la nube e híbridos. Data Classification normalmente se implementa usando un modelo SaaS, en el que el servicio se habilita a través de la interfaz de la Console y no requiere instalación de hardware ni software. Incluso en este modo de implementación de hacer clic y ejecutar, la gestión de datos se puede hacer sin importar si los almacenes de datos están en las instalaciones o en la nube pública.

¿Qué tipo de instancia o máquina virtual se requiere para la clasificación de datos?

Cuando"implementado en la nube" :

  • En AWS, Data Classification se ejecuta en una instancia m6i.4xlarge con un disco GP2 de 500 GiB.

  • En Azure, la clasificación de datos se ejecuta en una máquina virtual Standard_D16s_v3 con un disco de 500 GiB.

  • En GCP, la clasificación de datos se ejecuta en una máquina virtual n2-standard-16 con un disco persistente estándar de 500 GiB.

¿Puedo implementar la clasificación de datos en mi propio host?

Sí. Puede instalar el software de clasificación de datos en un host Linux que tenga acceso a Internet en su red o en la nube. Todo funciona de la misma manera y usted continúa administrando la configuración y los resultados del escaneo a través de la Consola. Ver"Implementación de la clasificación de datos en las instalaciones" para conocer los requisitos del sistema y los detalles de instalación.

¿Qué pasa con los sitios seguros sin acceso a Internet?

Sí, eso también es compatible. Puede"Implementar la clasificación de datos en un sitio local que no tiene acceso a Internet" para sitios completamente seguros.

¿Puedo migrar el agente de la Console o la instancia de Data Classification a otro host en una implementación de dark site?

No. No es posible migrar el agente de la Console a otro host cuando NetApp Data Classification está implementado en un agente de la Console. Si necesitas Classification en otro agente de la Console en un sitio dark, implementa un nuevo agente de la Console y una nueva instancia de Data Classification en el nuevo host.

Gestión de la clasificación de datos

Las siguientes preguntas ofrecen información sobre cómo gestionar NetApp Data Classification.

¿Cómo activo o desactivo la clasificación de datos?

Primero debe implementar una instancia de Clasificación de datos en la consola o en un sistema local. Una vez que la instancia esté en ejecución, puede habilitar el servicio en sistemas, bases de datos y otras fuentes de datos existentes desde la pestaña Configuración o seleccionando un sistema específico. "Aprenda cómo empezar" .

Nota La activación de la clasificación de datos en una fuente de datos da como resultado un escaneo inicial inmediato. Los resultados del escaneo se muestran poco después.

Puede deshabilitar la Clasificación de datos para que no escanee un sistema individual, una base de datos o un grupo de recursos compartidos de archivos desde la página Configuración de Clasificación de datos. Ver "Eliminar fuentes de datos de la Clasificación de datos" .

Para eliminar por completo la instancia de Data Classification, elimínala manualmente desde el portal de tu proveedor de servicios en la nube o desde tu ubicación local.

¿Puede el servicio excluir el escaneo de datos en ciertos directorios?

Sí. Si desea que la clasificación de datos excluya los datos escaneados que residen en determinados directorios de fuentes de datos, puede proporcionar esa lista al motor de clasificación. Después de aplicar ese cambio, la clasificación de datos excluirá el escaneo de datos en los directorios especificados. "Más información" .

¿Se escanean las instantáneas que residen en volúmenes ONTAP ?

No. La clasificación de datos no escanea instantáneas porque el contenido es idéntico al contenido del volumen.

¿Qué sucede si la clasificación de datos está habilitada en sus volúmenes ONTAP ?

Cuando la clasificación de datos explora volúmenes que tienen datos fríos agrupados por niveles en el almacenamiento de objetos mediante exploraciones de sólo mapa, explora todos los datos: los datos que están en discos locales y los datos fríos agrupados por niveles en el almacenamiento de objetos. Esto también se aplica a productos que no son de NetApp y que implementan la agrupación por niveles.

El escaneo «solo de mapas» no activa los datos inactivos: estos siguen inactivos y permanecen en el almacenamiento de objetos. Por otro lado, si realizas el escaneo completo, algunas configuraciones pueden activar los datos inactivos.

Sistemas de origen y tipos de datos

Las siguientes preguntas se relacionan con los tipos de almacenamiento que se pueden escanear y los tipos de datos que se escanean.

¿Existen restricciones al desplegarse en una región gubernamental?

La clasificación de datos se admite cuando el agente de la consola se implementa en una región gubernamental (AWS GovCloud, Azure Gov o Azure DoD), también conocido como "modo restringido".

¿Qué fuentes de datos puedo escanear si instalo Data Classification en un sitio sin acceso a Internet?

La clasificación de datos solo puede escanear datos de fuentes de datos que sean locales en el sitio local. En este momento, la clasificación de datos puede escanear las siguientes fuentes de datos locales en "modo privado", también conocido como sitio "oscuro":

  • Sistemas ONTAP locales

  • Esquemas de bases de datos

  • Almacenamiento de objetos que utiliza el protocolo de Servicio de almacenamiento simple (S3)

¿Qué tipos de archivos son compatibles?

La clasificación de datos escanea todos los archivos en busca de información sobre categorías y metadatos, y muestra todos los tipos de archivos en la sección de tipos de archivos del panel.

Cuando la función de clasificación de datos detecta información de carácter personal (PII) o cuando realiza una búsqueda en el marco de una solicitud de acceso a datos (DSAR), solo se admiten los siguientes formatos de archivo:

.CSV, .DCM, .DOC, .DOCX, .JSON, .PDF, .PPTX, .RTF, .TXT, .XLS, .XLSX, Docs, Sheets, and Slides

¿Qué tipos de datos y metadatos captura la clasificación de datos?

La clasificación de datos te permite realizar un análisis «solo de mapa» o un análisis completo en tus fuentes de datos. Los análisis «solo de mapa» solo ofrecen una visión a grandes rasgos de tus datos, mientras que los análisis completos proporcionan un análisis en profundidad de los mismos. Los análisis «solo de mapa» se pueden realizar en tus fuentes de datos con gran rapidez, ya que no acceden a los archivos para ver los datos que contienen.

  • Análisis solo de mapa: Data Classification analiza únicamente los metadatos. Esto resulta útil para la gestión y el control generales de los datos, la definición rápida del alcance de los proyectos, entornos muy extensos y el establecimiento de prioridades. El mapeo de datos se basa en los metadatos y se considera un análisis rápido.

    Después de un escaneo rápido, puede generar un informe de mapeo de datos. Este informe es una descripción general de los datos almacenados en sus fuentes de datos corporativas para ayudarlo a tomar decisiones sobre la utilización de recursos, la migración, la copia de seguridad, la seguridad y los procesos de cumplimiento.

  • Análisis completo: NetApp Data Classification analiza los datos utilizando protocolos estándar y permisos de solo lectura en todos tus entornos. Se abren determinados archivos y se analizan en busca de datos confidenciales relacionados con la empresa, información privada y problemas relacionados con el ransomware.

    Después de un análisis completo, hay muchas funciones de clasificación de datos adicionales que puede aplicar a sus datos, como ver y refinar datos en la página de investigación de datos, buscar nombres dentro de archivos, copiar, mover y eliminar archivos de origen, y más.

La Clasificación de datos captura metadatos como: nombre de archivo, permisos, hora de creación, último acceso y última modificación. Esto incluye todos los metadatos que aparecen en la página Data Investigation Details y en Data Investigation Reports.

La clasificación de datos puede identificar muchos tipos de datos privados, como información personal (PII) e información personal confidencial (SPII). Para obtener más detalles sobre los datos privados, consulteCategorías de datos privados que escanea la Clasificación de Datos .

Escaneo y análisis de clasificación de datos

Las siguientes preguntas se relacionan con el rendimiento del escaneo y el análisis de clasificación de datos.

¿Con qué frecuencia Data Classification escanea mis datos?

Si bien el escaneo inicial de sus datos puede llevar un poco de tiempo, los escaneos posteriores solo inspeccionan los cambios incrementales, lo que reduce los tiempos de escaneo del sistema. La clasificación de datos escanea sus datos de manera continua, en forma rotatoria, en seis repositorios a la vez, de modo que todos los datos modificados se clasifican muy rápidamente.

La clasificación de datos escanea las bases de datos solo una vez al día; las bases de datos no se escanean continuamente como otras fuentes de datos.

Los escaneos de datos tienen un impacto insignificante en sus sistemas de almacenamiento y en sus datos.

¿Varía el rendimiento del escaneo?

El rendimiento del análisis puede variar en función del ancho de banda de la red y del tamaño medio de los archivos en tu entorno. También puede depender del tamaño y la ubicación del sistema anfitrión (es decir, si está en la nube o en las instalaciones). Consulta "La instancia de Clasificación de Datos" y "Implementación de la clasificación de datos" para más información.

Al añadir inicialmente nuevas fuentes de datos, también puedes elegir realizar solo un escaneo de solo mapa o un escaneo completo. El mapeo se puede hacer en tus fuentes de datos muy rápido porque no accede a los archivos para ver los datos dentro. "Entiende la diferencia entre una exploración de mapeo y una exploración de clasificación".

¿Puedo buscar mis datos utilizando la clasificación de datos?

La clasificación de datos ofrece amplias capacidades de búsqueda que facilitan la búsqueda de un archivo o pieza de datos específicos en todas las fuentes conectadas. La clasificación de datos permite a los usuarios buscar más allá de lo que reflejan los metadatos. Es un servicio independiente del lenguaje que también puede leer los archivos y analizar una multitud de tipos de datos confidenciales, como nombres e identificaciones. Por ejemplo, los usuarios pueden buscar en almacenes de datos estructurados y no estructurados para encontrar datos que pueden haberse filtrado de las bases de datos a los archivos de usuario, en violación de la política corporativa. Las búsquedas se pueden guardar para más tarde y se pueden crear políticas para buscar y tomar medidas sobre los resultados con una frecuencia determinada.

Una vez que se encuentran los archivos de interés, se pueden enumerar las características, incluidas las etiquetas, la cuenta del sistema, el depósito, la ruta del archivo, la categoría (de la clasificación), el tamaño del archivo, la última modificación, el estado del permiso, los duplicados, el nivel de sensibilidad, los datos personales, los tipos de datos sensibles dentro del archivo, el propietario, el tipo de archivo, el tamaño del archivo, la hora de creación, el hash del archivo, si los datos se asignaron a alguien que buscaba su atención y más. Se pueden aplicar filtros para descartar características que no sean pertinentes.

La clasificación de datos también tiene control de acceso basado en roles (RBAC) para permitir que se muevan o eliminen archivos, si existen los permisos adecuados. Si no existen los permisos adecuados, las tareas se pueden asignar a alguien de la organización que sí tenga los permisos adecuados.

Si reinicio mi máquina virtual durante los análisis, ¿qué impacto tiene esto en el análisis?

Los análisis continúan. Si reinicias una máquina virtual mientras se están ejecutando los análisis, estos se reanudan desde donde se quedaron después de que la máquina virtual se reinicie correctamente.

Privacidad y acceso a los datos

Las siguientes preguntas se refieren al manejo de datos privados y al acceso a los datos en NetApp Data Classification.

¿Puedo limitar la información de clasificación de datos a usuarios específicos?

Sí, la clasificación de datos está completamente integrada con la NetApp Console. Los usuarios de la NetApp Console solo pueden ver la información de los sistemas que pueden ver según sus permisos.

Además, si desea permitir que ciertos usuarios solo vean los resultados del análisis de Clasificación de datos sin tener la capacidad de administrar las configuraciones de Clasificación de datos, puede asignar a esos usuarios el rol de Visor de clasificación (cuando use la NetApp Console en modo estándar) o el rol de Visor de cumplimiento (cuando use la NetApp Console en modo restringido). "Más información" .

¿Alguien puede acceder a los datos privados enviados entre mi navegador y Data Classification?

No. Los datos privados que se envían entre tu navegador y la instancia de Data Classification están protegidos mediante un cifrado de extremo a extremo con TLS 1.2, lo que significa que ni NetApp ni terceros pueden leerlos. Data Classification no comparte ningún dato ni resultado con NetApp a menos que tú lo solicites y autorices el acceso.

Los datos que se escanean permanecen dentro de su entorno.

¿Cómo se manejan los datos sensibles?

NetApp no ​​tiene acceso a datos confidenciales y no los muestra en la interfaz de usuario. Los datos sensibles se enmascaran, por ejemplo, se muestran los últimos cuatro números de la información de la tarjeta de crédito.

¿Dónde se almacenan los datos?

Los resultados del escaneo se almacenan en Elasticsearch dentro de su instancia de clasificación de datos.

¿Cómo se accede a los datos?

La clasificación de datos accede a los datos almacenados en Elasticsearch a través de llamadas API, que requieren autenticación y están encriptadas mediante AES-128. Para acceder directamente a Elasticsearch se requiere acceso root.