# Pipelines ML y Validación (Data Science & ML) > Pipelines de scikit-learn, cross-validation, GridSearchCV, RandomizedSearchCV, data leakage, estratificación - 22 preguntas de entrevista - Mid-Level - [Preguntas de entrevista: Data Science & ML](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista.md) ## 1. ¿Cuál es la principal ventaja de usar un Pipeline de scikit-learn en lugar de aplicar las transformaciones manualmente? **Respuesta** Un Pipeline garantiza que las mismas transformaciones se apliquen de manera consistente a los datos de entrenamiento y prueba. Encapsula todos los pasos de preprocesamiento y modelado en un solo objeto, lo que simplifica el código, previene el data leakage y facilita la puesta en producción del modelo. ## 2. ¿Qué método llamar en un Pipeline para entrenar todos los pasos y hacer una predicción? **Respuesta** El método fit_predict no existe para Pipelines de regresión o clasificación. Es necesario llamar primero a fit() para entrenar el pipeline, luego a predict() para obtener las predicciones. Alternativamente, fit() seguido de predict() pueden ser llamados por separado para mayor control. ## 3. ¿Qué es el data leakage en un contexto de machine learning? **Respuesta** El data leakage ocurre cuando información del conjunto de test o datos futuros se usa accidentalmente durante el entrenamiento. Puede ocurrir durante el preprocesamiento (calcular la media sobre todo el dataset antes del split) o mediante features que contienen indirectamente el objetivo. Resulta en un rendimiento artificialmente alto que no se generaliza. ## 19 preguntas más disponibles - ¿Cuál es el rol de ColumnTransformer en scikit-learn? - ¿Qué es la cross-validation K-Fold? Regístrate gratis: https://sharpskill.dev/es/login ## Otros temas de entrevista Data Science & ML - [Fundamentos de Python](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/python-basics.md): 25 preguntas, Junior - [Programación Orientada a Objetos en Python](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/python-oop.md): 20 preguntas, Junior - [Estructuras de datos en Python](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/python-data-structures.md): 20 preguntas, Junior - [Fundamentos de Git](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/git-fundamentals.md): 18 preguntas, Junior - [Fundamentos de SQL](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/sql-basics.md): 20 preguntas, Junior - [Fundamentos de NumPy](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/numpy-fundamentals.md): 22 preguntas, Junior - [Fundamentos de Pandas](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/pandas-basics.md): 22 preguntas, Junior - [Jupyter & Google Colab](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/jupyter-colab.md): 16 preguntas, Junior - [SQL Joins y consultas avanzadas](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/sql-joins-advanced.md): 22 preguntas, Mid-Level - [Pandas avanzado](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/pandas-advanced.md): 24 preguntas, Mid-Level - [Visualización con Matplotlib & Seaborn](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/matplotlib-seaborn.md): 20 preguntas, Mid-Level - [Visualizaciones interactivas con Plotly](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/plotly-interactive.md): 18 preguntas, Mid-Level - [Estadística descriptiva](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/statistics-descriptive.md): 20 preguntas, Mid-Level - [Estadística inferencial](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/statistics-inferential.md): 24 preguntas, Mid-Level - [Web Scraping](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/web-scraping.md): 18 preguntas, Mid-Level - [BigQuery & Cloud Data](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/bigquery-cloud.md): 18 preguntas, Mid-Level - [Feature Engineering](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/feature-engineering.md): 22 preguntas, Mid-Level - [ML Supervisado: Regresión](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/ml-supervised-regression.md): 24 preguntas, Mid-Level - [ML Supervisado: Clasificación](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/ml-supervised-classification.md): 24 preguntas, Mid-Level - [Árboles de Decisión y Ensembles](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/ml-trees-ensembles.md): 24 preguntas, Mid-Level - [ML No Supervisado](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/ml-unsupervised.md): 22 preguntas, Mid-Level - [Series Temporales y Pronóstico](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/time-series-forecasting.md): 22 preguntas, Mid-Level - [Fundamentos de Deep Learning](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/deep-learning-fundamentals.md): 24 preguntas, Senior - [TensorFlow & Keras](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/tensorflow-keras.md): 22 preguntas, Senior - [CNN y clasificación de imágenes](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/cnn-image-classification.md): 24 preguntas, Senior - [RNN y Secuencias](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/rnn-sequences.md): 22 preguntas, Senior - [Transformers y Attention](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/transformers-attention.md): 24 preguntas, Senior - [NLP y Hugging Face](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/nlp-huggingface.md): 24 preguntas, Senior - [GenAI y LangChain](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/genai-langchain.md): 24 preguntas, Senior - [MLOps y Despliegue](https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/mlops-deployment.md): 24 preguntas, Senior --- Source: SharpSkill (https://sharpskill.dev), tech interview preparation for your real stack. HTML version of this page: https://sharpskill.dev/es/technologies/data-science/preguntas-entrevista/ml-pipelines-validation