Etiquetado de datos

data labeling

El etiquetado de datos es marcar ejemplos para que un sistema de inteligencia artificial aprenda qué hay en una imagen, un texto o un audio. En inglés, data labeling. Sin etiquetas fiables, el modelo aprende el error con la misma seguridad.

En una línea de producción se marca “fisura” o “pieza buena”. En un clasificador de correos, “urgente”, “presupuesto”, “spam”. El trabajo es tedioso y decide la calidad. Si tres personas etiquetan distinto el mismo caso, el modelo hereda el caos. Conviene una guía corta, un control de calidad por muestreo y, cuando el dato es personal, el marco de protección de datos.

Una fábrica de azulejos en Castellón dedicó dos semanas a etiquetar defectos reales antes de comprar la cámara “inteligente”. El acierto posterior pagó esas semanas. Etiquetar no es un trámite de informáticos. Es decidir qué cuenta como verdad en el negocio. Si esa verdad está mal, la IA la reproduce a escala.

Pattterns ahora es Ocelot