Una comparación lado a lado entre datos de entrenamiento y conjunto de prueba. Comprenda por qué los datos usados para ajustar un modelo deben separarse de los datos reservados usados para evaluarlo.
Veredicto rápido: Use Datos de entrenamiento para enseñar o ajustar el modelo; use Conjunto de prueba para estimar de forma independiente el rendimiento en datos no vistos.
Training Data defines dataset used to teach or fit a machine learning model by adjusting its learnable parameters.
Contexto: Más relevante durante el desarrollo del modelo, cuando los ejemplos se usan para ajustar parámetros del modelo.
Test Set defines reserved dataset used to provide an independent evaluation of a trained model or AI system.
Contexto: Más relevante durante la evaluación final o los controles de preparación para lanzamiento.
| Aspecto | Training Data | Test Set |
|---|---|---|
| Propósito | Los datos de entrenamiento enseñan o ajustan el modelo modificando parámetros aprendibles. | Un conjunto de prueba proporciona una evaluación independiente de un modelo entrenado o sistema de IA. |
| Uso en el ciclo de vida | Se usan durante el entrenamiento y desarrollo del modelo. | Se usa después del entrenamiento para estimar el rendimiento antes del despliegue o lanzamiento. |
| Riesgo de fuga | El riesgo surge si ejemplos de prueba influyen en el entrenamiento o la selección del modelo. | El riesgo surge si el conjunto de prueba reservado se reutiliza, se usa para ajustar o queda expuesto durante el desarrollo. |
| Valor probatorio | Muestra qué datos dieron forma al modelo y su postura de cumplimiento. | Respalda afirmaciones de rendimiento en datos no vistos cuando se mantiene independiente. |
| Error común | Usar todos los datos disponibles para entrenamiento y no dejar un conjunto de evaluación independiente. | Revisar repetidamente el conjunto de prueba hasta que el modelo queda indirectamente optimizado para él. |
En la práctica, el conjunto de prueba no es solo otra partición de datos; forma parte del sistema de evidencia que hace creíbles las afirmaciones de rendimiento.
Entrenar con datos que deberían haberse reservado para pruebas.
Tratar resultados del conjunto de prueba como independientes después de ajustarse repetidamente contra ellos.
Documentar el rendimiento del modelo sin registrar la lógica de partición de datos y los controles de fuga.
Use Datos de entrenamiento cuando se refiera al conjunto de datos usado para ajustar un modelo de aprendizaje automático y sus parámetros aprendibles. Debe documentarse respecto de calidad, diversidad, etiquetas, procedencia e impacto de cumplimiento.
Use Conjunto de prueba cuando se refiera a datos reservados para la evaluación independiente de un modelo entrenado o sistema de IA. Debe permanecer separado de datos de entrenamiento y validación para respaldar estimaciones confiables de rendimiento.
Esta distinción importa para evidencia de estilo Reglamento de IA de la UE, aseguramiento de IA e informes de validación. Si los datos de prueba se filtran al entrenamiento o ajuste, las afirmaciones de rendimiento pueden volverse poco fiables y difíciles de defender.
La separación ayuda a que el conjunto de prueba estime el comportamiento en datos no vistos, no en ejemplos memorizados o indirectamente optimizados.
No deberían usarse para selección o ajuste ordinario de modelos. Los datos de validación son la partición más adecuada para evaluación durante el desarrollo.
La evaluación puede volverse demasiado optimista, debilitando la evidencia de auditoría y las afirmaciones de rendimiento.
No recently viewed comparisons yet.