Let's discuss your project

Home
/
Blog
/
PLN
/

Anotación NLP: etiquetas de alta calidad para NER, intención, SRL y vinculación de entidades

Last updated:
03.08.2026
Read time:
X
min
Author:
Roy Andraos
Aprenda cómo la anotación NLP mejora NER, intención, SRL y vinculación de entidades con guías, control de calidad y flujos de datos fiables.

Este artículo explica cómo la anotación NLP influye en NER, detección de intención, SRL y vinculación de entidades, con foco en guías, control de calidad, diseño de conjuntos de datos y flujos de trabajo para sistemas de lenguaje en producción.

Topics
Keypoints
  • La anotación de PLN de alta calidad es la base que sostiene la precisión de los modelos de lenguaje modernos.
  • Estudios del Stanford NLP Group subrayan que la calidad de la anotación puede influir en los resultados del modelo incluso más que el tamaño del conjunto de datos.
  • Si los límites de las entidades varían dentro de un conjunto de datos o las categorías de intención se solapan, el modelo interioriza señales contradictorias que debilitan su razonamiento.
  • Las etiquetas de argumentos describen cómo participan las entidades en los eventos, y el etiquetado inconsistente altera la comprensión del modelo sobre las relaciones.

La anotación de PLN de alta calidad es la base que sostiene la precisión de los modelos de lenguaje modernos. Cuando los datos se etiquetan con claridad y consistencia, los modelos aprenden a reconocer entidades, inferir intenciones, mapear estructuras de predicados y conectar menciones con las referencias correctas con mayor confianza. Cada decisión de anotación afecta a la forma en que el modelo interpreta el lenguaje durante su implementación, lo que significa que incluso errores pequeños pueden propagarse y convertirse en problemas de rendimiento significativos. Estudios del Stanford NLP Group subrayan que la calidad de la anotación puede influir en los resultados del modelo incluso más que el tamaño del conjunto de datos. Para los equipos que dependen de sistemas de PLN para automatizar soporte, analizar documentos o extraer significado estructurado del texto, invertir en flujos de trabajo de anotación bien organizados es esencial.

Por qué la anotación NLP es importante para el rendimiento del modelo

Los modelos aprenden patrones directamente de los ejemplos que reciben, y la anotación guía la formación de esos patrones. Si los límites de las entidades varían dentro de un conjunto de datos o las categorías de intención se solapan, el modelo interioriza señales contradictorias que debilitan su razonamiento. Por ello, los equipos deben mantener definiciones claras de categorías, reglas de límites consistentes y un proceso de revisión estructurado para evitar que ejemplos ruidosos condicionen el comportamiento del modelo. La investigación compartida a través de la ACL Anthology muestra que el etiquetado inconsistente reduce la precisión en tareas posteriores como la generación de resúmenes, la respuesta a preguntas y el análisis de sentimiento. Cuando la calidad de la anotación es alta, los modelos aprenden señales estructurales estables que favorecen una generalización más fiable, especialmente cuando se exponen a vocabulario o formulaciones desconocidas.

Cómo la anotación moldea el reconocimiento de entidades nombradas

El reconocimiento de entidades nombradas depende de que los anotadores identifiquen correctamente los segmentos de entidad y decidan si una frase se refiere a una entidad real, a una expresión descriptiva o a una metáfora. La dificultad no está en identificar entidades típicas, sino en gestionar construcciones ambiguas como divisiones de empresas, nombres temporales de proyectos o subtipos de productos. Los anotadores también deben decidir cómo tratar las expresiones de varias palabras y cuándo marcar entidades anidadas. Las reglas claras reducen la variación aleatoria, especialmente en corpus grandes donde distintos anotadores pueden interpretar patrones similares de manera diferente. Como se señala en recursos educativos de Hugging Face, la claridad en los límites de las entidades es un factor importante para la estabilidad del modelo. Cuando los equipos de anotación utilizan ejemplos para ilustrar casos complejos o limítrofes, los conjuntos de datos resultantes producen modelos que interpretan el texto del mundo real con mayor precisión.

Gestión de casos límite en NER

Los casos límite suelen revelar inconsistencias de interpretación, y esas inconsistencias pueden ampliarse a medida que crece el conjunto de datos. Expresiones como eslóganes de marca o regiones geográficas usadas de forma metafórica requieren decisiones explícitas para evitar un etiquetado contradictorio. Cuando los anotadores comprenden cómo tratar estas estructuras inusuales, mantienen la coherencia de la taxonomía de entidades. Los equipos también pueden integrar listas breves de referencia o glosarios que aclaren qué entidades pertenecen a cada categoría. Esto reduce la confusión y ayuda a los anotadores a evitar interpretaciones diferentes de los mismos términos entre lotes.

Resolución de entidades anidadas o solapadas

Las entidades anidadas aparecen cuando una entidad está contenida dentro de otra, y una gestión incorrecta de estos casos suele debilitar la comprensión del modelo sobre la estructura jerárquica. Los anotadores deben determinar si el proyecto requiere marcar todos los segmentos anidados o solo los más informativos. Esta elección debe mantenerse de forma consistente en todo el conjunto de datos. Cuando los segmentos anidados se gestionan de manera sistemática, los modelos aprenden a diferenciar entre referencias de entidad amplias y específicas. Estos casos también ponen de relieve la importancia de que los equipos se alineen en torno a una única estrategia de interpretación antes de que comience la anotación.

Importancia del contexto en el etiquetado de entidades

El contexto determina el significado de muchas menciones de entidad, especialmente cuando los términos representan categorías diferentes según su uso. Los anotadores deben examinar las oraciones cercanas en lugar de etiquetar palabras de forma aislada para evitar interpretaciones superficiales. Esto es especialmente importante en nombres ambiguos que pueden referirse a múltiples entidades posibles. Proporcionar a los anotadores visibilidad a nivel de documento reduce el número de etiquetas incorrectas. Con el tiempo, el razonamiento contextual consistente enseña al modelo a inferir significado a partir de señales lingüísticas más amplias, no solo de palabras aisladas.

Principios de anotación para la detección de intención

La detección de intención se centra en identificar los objetivos del usuario a partir de oraciones o frases breves, lo que exige que los anotadores interpreten el significado incluso cuando la formulación varía de forma considerable. Una taxonomía de intenciones bien construida evita el solapamiento entre categorías e impide que los anotadores elijan etiquetas diferentes para consultas semánticamente idénticas. Cuando las categorías no son claras o cuando intenciones similares se colocan demasiado cerca entre sí, el desacuerdo humano aumenta notablemente. La investigación del LTI de Carnegie Mellon University (https://lti.cs.cmu.edu) destaca que los modelos de intención entrenados con taxonomías ambiguas fallan con más frecuencia en entornos reales de chat. Establecer categorías simples y no solapadas ayuda a los anotadores a aplicar etiquetas de forma consistente, lo que refuerza la coherencia de los datos de entrenamiento.

Equilibrar granularidad y claridad

Las categorías de intención deben ser lo bastante detalladas para resultar útiles, pero lo bastante simples para que los anotadores las apliquen con confianza. Las taxonomías demasiado granulares generan confusión porque los anotadores deben diferenciar entre intenciones que pueden parecer idénticas en el uso. Cuando las categorías alcanzan el nivel adecuado de granularidad, los anotadores pueden etiquetar ejemplos sin una carga cognitiva excesiva. Las distinciones claras generan puntuaciones de confianza más sólidas en el modelo y menos errores de clasificación durante la implementación. Crear este equilibrio requiere revisar consultas de muestra y asegurarse de que los límites entre categorías tengan sentido tanto para los anotadores como para los diseñadores del sistema.

Anotación de paráfrasis y variaciones

Los usuarios expresan la misma intención de muchas formas distintas, y los anotadores deben asegurarse de interpretar el significado en lugar de la formulación superficial. Un conjunto de datos con una cobertura sólida de paráfrasis permite que los modelos comprendan expresiones semánticamente equivalentes, incluso cuando el vocabulario o la estructura de la oración cambian de forma significativa. Los anotadores necesitan formación para evaluar si dos oraciones transmiten la misma intención pese a diferencias superficiales. Documentar ejemplos de paráfrasis ayuda a construir una intuición común en todo el equipo de anotación. Este proceso da lugar a modelos que reconocen la intención con mayor precisión en entradas impredecibles del mundo real.

Evitar categorías de intención ambiguas

Las categorías de intención ambiguas hacen que los anotadores dependan del juicio subjetivo, lo que debilita la fiabilidad del conjunto de datos. Para evitarlo, las definiciones de categorías deben incluir descripciones precisas y varios ejemplos que ilustren casos aceptables y no aceptables. Cuando las categorías solapadas se fusionan o eliminan, los anotadores pueden tomar decisiones con mayor confianza. Esta claridad también reduce las tasas de desacuerdo, lo que mejora las métricas de control de calidad en todo el conjunto de datos. En última instancia, las estructuras de categorías más limpias permiten que los modelos interpreten los objetivos del usuario con menos falsos positivos.

Anotación de alta calidad para el etiquetado de roles semánticos

El etiquetado de roles semánticos captura la estructura profunda de las oraciones al identificar predicados y los roles asociados con cada argumento. Los anotadores deben comprender la gramática y la semántica con suficiente profundidad para distinguir entre agentes, pacientes, instrumentos y otros tipos de roles. Cuando las guías definen con claridad cómo tratar cada estructura, los anotadores producen mapeos predicado-argumento consistentes. El trabajo del CLIP Lab de University of Colorado (https://clip.colorado.edu) muestra que la anotación SRL de alta calidad mejora el rendimiento en tareas como la generación de resúmenes y la recuperación de información, al ayudar a los modelos a interpretar la estructura de eventos con mayor precisión.

Identificar predicados con precisión

Los anotadores deben determinar si un verbo funciona como predicado o cumple otra función en la oración. Cuando los predicados se identifican de forma incorrecta, toda la estructura de argumentos se vuelve poco fiable. Las guías deben incluir ejemplos de predicados en distintos contextos sintácticos para minimizar la confusión. Se recomienda que los anotadores revisen colectivamente los casos difíciles para establecer una interpretación compartida. Este enfoque mantiene la consistencia y refuerza la claridad de los límites de los predicados en todo el conjunto de datos.

Asignar argumentos de forma consistente

Las etiquetas de argumentos describen cómo participan las entidades en los eventos, y el etiquetado inconsistente altera la comprensión del modelo sobre las relaciones. Los anotadores deben apoyarse en definiciones que expliquen con claridad cada rol, especialmente en oraciones complejas con múltiples interpretaciones posibles. Revisar ejemplos de asignaciones correctas e incorrectas ayuda a los equipos a evitar errores recurrentes. Cuando los anotadores comprenden el significado funcional detrás de cada etiqueta, pueden aplicarlas con mayor precisión. La anotación consistente de argumentos permite que el modelo detecte la estructura de eventos con mayor claridad.

Gestionar estructuras oracionales complejas

Las oraciones largas con cláusulas incrustadas suelen suponer un reto para los anotadores porque las relaciones predicado-argumento se vuelven más difíciles de interpretar. Las guías deben explicar cómo tratar cláusulas subordinadas, construcciones pasivas y expresiones idiomáticas que influyen en el significado. Los equipos se benefician de revisar juntos ejemplos complejos para resolver casos ambiguos. Mantener esta alineación ayuda a crear estructuras de argumentos coherentes en todo el conjunto de datos. Estos esfuerzos garantizan que el modelo aprenda a gestionar patrones sintácticos complejos con menos errores.

Qué exige la vinculación de entidades a los anotadores

La vinculación de entidades conecta menciones textuales con entradas específicas de una base de conocimiento, lo que exige un razonamiento contextual profundo. Los anotadores deben elegir el referente correcto cuando varias entidades comparten el mismo nombre o cuando el texto proporciona pistas sutiles sobre la referencia prevista. Una vinculación incorrecta desorienta al modelo y afecta a las aplicaciones que dependen de la recuperación de conocimiento estructurado. Por ello, los anotadores necesitan formación sobre cómo usar la base de datos de referencia y cómo interpretar frases ambiguas que pueden apuntar a varias entidades posibles.

Usar correctamente las bases de conocimiento de referencia

Los anotadores deben navegar por la base de conocimiento con confianza y verificar que la entidad elegida coincide con el contexto. Si la base de datos contiene entradas obsoletas o carece de cobertura en determinados dominios, los anotadores deben marcar la mención como desconocida en lugar de forzar una coincidencia. Los proyectos deben proporcionar instrucciones sobre cómo comparar atributos entre entidades posibles. Estos pasos reducen las asociaciones incorrectas y mantienen la integridad del conjunto de datos. El uso adecuado de la base de conocimiento también favorece decisiones de vinculación consistentes entre anotadores.

Desambiguar entidades similares

Cuando distintas entidades comparten nombres idénticos, los anotadores deben apoyarse en señales contextuales como referencias geográficas, cargos profesionales o afiliaciones organizativas. Este proceso requiere atención al matiz y una lectura detallada del texto circundante. Las guías claras ayudan a los anotadores a comprender qué pistas son más relevantes al resolver ambigüedades. Cuando estas decisiones se documentan, el conjunto de datos mantiene la consistencia entre lotes. Esta claridad también prepara a los modelos para interpretar con mayor precisión documentos con muchas referencias.

Gestionar entradas ausentes o ambiguas

Algunas menciones no corresponden a ninguna entrada existente en la base de conocimiento, y forzar una coincidencia crea errores a largo plazo en el sistema. Los anotadores deben marcar estos casos como desconocidos o no respaldados según el esquema de etiquetado del proyecto. Esto evita que asociaciones incorrectas entren en los datos de entrenamiento del modelo. Los equipos deben documentar cómo tratar coincidencias parciales o menciones incompletas. Cuando estas guías se siguen de manera consistente, la precisión general de la vinculación mejora de forma notable.

Diseño de guías para una anotación consistente

Las guías de anotación definen la lógica de interpretación que deben seguir todos los anotadores. Sin instrucciones claras, incluso los anotadores experimentados pueden divergir en sus decisiones y producir un conjunto de datos con etiquetas inconsistentes. Las guías deben incluir definiciones, ejemplos, contraejemplos y aclaraciones para casos ambiguos. También deben especificar cómo gestionar construcciones poco frecuentes, expresiones de varias palabras y terminología específica del dominio. Actualizar las guías de forma regular garantiza que los nuevos patrones descubiertos durante la revisión queden estandarizados.

Proporcionar ejemplos para mayor claridad

Los ejemplos ilustran cómo deben aplicarse las etiquetas y ayudan a los anotadores a desarrollar intuición. También sirven como referencias para casos limítrofes en los que los anotadores podrían dudar. Incluir ejemplos positivos y negativos garantiza que los anotadores comprendan tanto las interpretaciones correctas como las incorrectas. Los equipos deben actualizar los ejemplos para reflejar nuevos desafíos a medida que el proyecto evoluciona. Este refinamiento continuo fortalece la consistencia del conjunto de datos con el tiempo.

Documentar decisiones sobre casos disputados

Los casos disputados aparecen cuando los anotadores no coinciden en la interpretación, y documentar la resolución ayuda a evitar confusiones repetidas. Estas decisiones deben recopilarse en un registro compartido que los anotadores puedan consultar. Esto previene el etiquetado inconsistente cuando casos similares reaparecen más adelante en el conjunto de datos. Documentar casos complejos también ayuda a perfeccionar las guías y mejorar la formación de nuevos anotadores. Este hábito refuerza la fiabilidad del flujo de trabajo general.

Mantener control de versiones

Las guías suelen evolucionar, y los anotadores deben utilizar siempre la versión más reciente. El control de versiones garantiza que todos los miembros del equipo permanezcan alineados y que los cambios se registren con claridad. Los anotadores también deben revisar versiones anteriores cuando sea necesario para comprender cómo han evolucionado las reglas de interpretación. Mantener las guías actualizadas ayuda a mejorar la calidad del conjunto de datos a medida que surgen nuevos aprendizajes. Este nivel de organización reduce la confusión y hace que el proceso de anotación sea más predecible.

Métodos de control de calidad que mejoran la fiabilidad del conjunto de datos

El control de calidad garantiza que las anotaciones sigan siendo precisas y consistentes durante todo el proyecto. La revisión por múltiples anotadores permite a los equipos comparar interpretaciones y resolver desacuerdos. El muestreo aporta visibilidad sobre errores recurrentes o patrones de confusión. La validación automatizada detecta problemas estructurales como segmentos solapados o desajustes de categoría. Combinar estas estrategias crea un flujo de trabajo resistente que mantiene la calidad en todo el conjunto de datos.

Flujos de trabajo con múltiples anotadores

Cuando varios anotadores etiquetan la misma muestra, los desacuerdos revelan con qué consistencia se están aplicando las guías. Estos desacuerdos ayudan a identificar definiciones poco claras o categorías que pueden necesitar revisión. Analizar los patrones de desacuerdo refuerza la alineación del equipo de anotación. El proceso también pone de manifiesto tendencias individuales de anotación que pueden requerir formación adicional. Con el tiempo, los flujos de trabajo con múltiples anotadores producen mayor acuerdo y conjuntos de datos más limpios.

Sesiones periódicas de calibración

Las sesiones de calibración ofrecen a los equipos la oportunidad de debatir casos complejos y realinear sus interpretaciones. Los anotadores pueden comparar razonamientos, aclarar incertidumbres y actualizar las guías de forma colaborativa. Estas sesiones son especialmente valiosas para tareas con alta ambigüedad, como la vinculación de entidades o el SRL. La calibración periódica también apoya a los nuevos anotadores al proporcionarles exposición directa al razonamiento experto. Como resultado, todo el equipo se vuelve más consistente en la aplicación de etiquetas.

Muestreo para revisión profunda

El muestreo consiste en revisar en profundidad un subconjunto de ejemplos anotados para descubrir errores que podrían no aparecer en las comprobaciones automatizadas. Los revisores pueden evaluar si las etiquetas siguen las guías, si se respetaron las reglas de límites y si las construcciones ambiguas se gestionaron correctamente. Esta estrategia ayuda a identificar tendencias en la calidad de la anotación y señala áreas donde puede requerirse formación adicional. La revisión profunda también aumenta la confianza en que el conjunto de datos mantiene su coherencia con el tiempo. Mantener un proceso de muestreo estructurado garantiza que la calidad siga siendo alta incluso a medida que crece el conjunto de datos.

Integración de la anotación NLP en flujos de IA reales

Integrar datos anotados en sistemas de IA en producción requiere una estructura clara del conjunto de datos, una distribución equilibrada entre categorías y divisiones bien organizadas de entrenamiento, validación y prueba. La calidad de la anotación influye directamente en la estabilidad del modelo durante el ajuste fino y la implementación. Un conjunto de datos con etiquetas consistentes favorece ciclos de reentrenamiento más fluidos y una expansión más sencilla cuando se introducen nuevas categorías o dominios. Los equipos también deben supervisar cómo evoluciona el rendimiento del modelo a medida que más datos anotados entran en el flujo de trabajo.

Técnicas de equilibrio del conjunto de datos

Los conjuntos de datos de contenido equilibrados garantizan que todas las categorías reciban representación suficiente, lo que evita que los modelos se sobreajusten a las etiquetas frecuentes. Es posible que los anotadores deban centrarse en recopilar ejemplos adicionales para clases poco frecuentes con el fin de mantener este equilibrio. Los conjuntos de datos equilibrados también favorecen evaluaciones más justas al reducir métricas de rendimiento sesgadas. Los equipos deben supervisar la distribución de categorías durante todo el proyecto para evitar desequilibrios no intencionados. Esta supervisión ayuda a mantener una generalización robusta en escenarios reales.

Preparar referencias de evaluación

Las referencias de evaluación ofrecen una visión imparcial del rendimiento del modelo al aislar una parte de los datos reservada exclusivamente para pruebas. Estas referencias deben reflejar la variedad y complejidad del conjunto de datos completo para ofrecer información significativa. Los anotadores deben asegurarse de que los ejemplos de prueba se etiqueten con el mismo cuidado aplicado a los datos de entrenamiento. Los equipos también deben documentar cómo se crearon las referencias para mantener la reproducibilidad. Unas referencias de evaluación sólidas dan a los desarrolladores confianza en que el modelo se comporta de forma fiable en condiciones realistas.

Apoyo a mejoras iterativas

A medida que avanza la anotación, los equipos suelen descubrir nuevos patrones o casos límite que requieren actualizaciones de las guías o ajustes de la taxonomía. Un conjunto de datos bien estructurado apoya esta mejora iterativa al permitir integrar nuevos ejemplos sin alterar los patrones existentes. Los equipos deben revisar cómo los ejemplos añadidos recientemente influyen en el rendimiento del modelo y ajustar las estrategias de anotación en consecuencia. Mantener flexibilidad sin perder consistencia da como resultado un conjunto de datos que evoluciona de manera estable junto con los requisitos del sistema. Estas prácticas ayudan a garantizar que el modelo continúe mejorando a lo largo de los ciclos de entrenamiento y refinamiento.

Si está creando o perfeccionando un conjunto de datos de PLN y necesita apoyo con la estructura de anotación, el diseño del flujo de trabajo o el control de calidad, se puede explorar cómo DataVLab ayuda a los equipos a desarrollar datos etiquetados consistentes, escalables y aptos para producción en aplicaciones avanzadas de lenguaje.

¿Qué es la anotación NLP?

Este artículo explica cómo la anotación NLP influye en NER, detección de intención, SRL y vinculación de entidades, con foco en guías, control de calidad, diseño de conjuntos de datos y flujos de trabajo para sistemas de lenguaje en producción.

¿Por qué la anotación NLP es importante para el rendimiento del modelo?

Los modelos aprenden patrones directamente de los ejemplos que reciben, y la anotación guía la formación de esos patrones. Si los límites de las entidades varían dentro de un conjunto de datos o las categorías de intención se solapan, el modelo interioriza señales contradictorias que debilitan su razonamiento.

¿Cómo la anotación moldea el reconocimiento de entidades nombradas?

El reconocimiento de entidades nombradas depende de que los anotadores identifiquen correctamente los segmentos de entidad y decidan si una frase se refiere a una entidad real, a una expresión descriptiva o a una metáfora. La dificultad no está en identificar entidades típicas, sino en gestionar construcciones ambiguas como divisiones de empresas, nombres temporales de proyectos o subtipos de productos.

¿Cómo se puede garantizar la calidad?

El etiquetado de roles semánticos captura la estructura profunda de las oraciones al identificar predicados y los roles asociados con cada argumento. Los anotadores deben comprender la gramática y la semántica con suficiente profundidad para distinguir entre agentes, pacientes, instrumentos y otros tipos de roles.

¿Qué exige la vinculación de entidades a los anotadores?

La vinculación de entidades conecta menciones textuales con entradas específicas de una base de conocimiento, lo que exige un razonamiento contextual profundo. Los anotadores deben elegir el referente correcto cuando varias entidades comparten el mismo nombre o cuando el texto proporciona pistas sutiles sobre la referencia prevista.

¿Qué explica la sección «Métodos de control de calidad que mejoran la fiabilidad del conjunto de datos»?

El control de calidad garantiza que las anotaciones sigan siendo precisas y consistentes durante todo el proyecto. La revisión por múltiples anotadores permite a los equipos comparar interpretaciones y resolver desacuerdos. El muestreo aporta visibilidad sobre errores recurrentes o patrones de confusión.

Roy Andraos

CEO DataVlab
Fundador de DataVLab, una empresa de anotación de datos que acompaña a equipos de IA en sanidad, agricultura, retail, imágenes satelitales y otros sectores con gran carga visual. Desde 2019 ayudamos a las organizaciones a convertir datos complejos de imagen, vídeo y texto en conjuntos de entrenamiento fiables, combinando experiencia operativa con un enfoque riguroso en la calidad y la escalabilidad de las anotaciones.

Let's discuss your project

We can provide realible and specialised annotation services and improve your AI's performances

Abstract blue gradient background with a subtle grid pattern.

Explore nuestros diferentes
Aplicaciones industriales

Nuestros servicios de etiquetado de datos se adaptan a diversas industrias, lo que garantiza anotaciones de alta calidad adaptadas a sus necesidades específicas.

Servicios de anotación de datos

Libere todo el potencial de sus aplicaciones de IA con nuestra tecnología experta en etiquetado de datos. Garantizamos anotaciones de alta calidad que aceleran los plazos de sus proyectos.

Servicios de anotación de datos de PNL

Anotación de datos para PNL

Etiquetado de texto para PNL: clasificación, entidades y extracción con control de calidad.

Servicios de anotación de datos de texto

Anotación de texto para IA

Servicios de anotación de texto para IA: conjuntos de datos consistentes con control de calidad.

Servicios de etiquetado de datos para LLM y RLHF

Anotación de datos para LLM

Datos para LLM: ajuste de instrucciones, evaluación y RLHF con control de calidad.

Servicios de anotación OCR e IA documental

Anotación OCR e IA documental

Comprensión documental: segmentación, extracción de campos y clasificación con control de calidad.