Caesar AI Atlas

Base de conocimientos

Preguntas: Model Evaluation & Monitoring

Respuestas autorizadas a preguntas técnicas, de gobernanza y cumplimiento de IA. Escrito para equipos legales, de cumplimiento e ingeniería.

40

Guías completas

120

Total de P&R

Todas las preguntas (120)Guías completas (40)Solo FAQ (80)Limpiar filtro
Filtrar por dificultad:

Principiante

Intermedio

Alta prioridadIntermedio

¿Qué es una puntuación F1?

La puntuación F1 es la media armónica de la precisión y la exhaustividad, utilizada para evaluar el rendimiento en clasificación y extracción de información. Va de 0 a 1, donde los valores más altos indican un mejor equilibrio entre positivos correctamente identificados y positivos omitidos.

1 término1 tema
Prioridad mediaIntermedio

¿En qué se diferencian los falsos positivos y los falsos negativos?

Usa falso positivo para una marca positiva incorrecta; usa falso negativo para una omisión incorrecta al no detectar una condición positiva real.

1 término1 tema
Prioridad mediaIntermedio

¿Qué es un umbral de clasificación?

Un umbral de clasificación es un valor de corte elegido para convertir la puntuación o probabilidad de un modelo en una predicción de clase. Cambiar el umbral puede alterar el equilibrio entre falsos positivos y falsos negativos, por lo que la selección del umbral es una decisión importante de gobernanza y rendimiento.

1 término1 tema
Prioridad mediaIntermedio

¿Qué son los datos de validación?

Los datos de validación son datos usados para evaluar un modelo durante el desarrollo y ajustar decisiones como hiperparámetros, umbrales o procesos de aprendizaje. Deben ser distintos de los datos de entrenamiento y prueba para ayudar a detectar subajuste, sobreajuste y problemas de generalización.

1 término1 tema
Prioridad mediaIntermedio

¿Qué es un conjunto de prueba?

Un conjunto de prueba es un conjunto de datos reservado que se usa para proporcionar una evaluación independiente de un modelo entrenado o sistema de IA. Debe separarse de los datos de entrenamiento y validación para que las estimaciones de rendimiento reflejen mejor el comportamiento sobre datos no vistos antes del despliegue o lanzamiento.

1 término1 tema
Prioridad mediaIntermedio

¿Qué es la supervisión de modelos?

La supervisión de modelos es la observación continua del rendimiento, las entradas, las salidas, la deriva, los errores, la latencia y la salud operativa de un modelo desplegado. Ayuda a detectar degradación, uso indebido, sesgo, problemas de seguridad y condiciones que requieren reentrenamiento o intervención.

1 término1 tema

Avanzado