# Feature Engineering (Data Science & ML) > Kategoriales Encoding, Scaling, Normalisierung, Feature Selection, Feature-Erstellung, Pipelines - 22 Interview-Fragen - Mid-Level - [Interview-Fragen: Data Science & ML](https://sharpskill.dev/de/technologies/data-science/interviewfragen.md) ## 1. Welcher Encoding-Typ sollte für eine nominale kategoriale Variable mit wenigen unterschiedlichen Kategorien (weniger als 10) verwendet werden? **Antwort** One-Hot Encoding ist ideal für nominale Variablen mit wenigen Kategorien, da es für jede Kategorie eine binäre Spalte erstellt, ohne eine künstliche Ordnung einzuführen. Im Gegensatz zu Label Encoding, das Zahlen (0, 1, 2...) zuweist, verhindert One-Hot, dass das Modell eine nicht existierende ordinale Beziehung zwischen Kategorien interpretiert. ## 2. Was ist der Hauptunterschied zwischen StandardScaler und MinMaxScaler? **Antwort** StandardScaler zentriert Daten um 0 mit einer Standardabweichung von 1 (z-Score), während MinMaxScaler Daten in einem festen Bereich normalisiert, normalerweise [0, 1]. StandardScaler ist weniger empfindlich gegenüber Ausreißern, da es Mittelwert und Standardabweichung verwendet, während MinMaxScaler stark von Extremwerten beeinflusst werden kann. ## 3. Welcher Scaler sollte bevorzugt werden, wenn die Daten signifikante Ausreißer enthalten? **Antwort** RobustScaler verwendet Median und Interquartilsabstand (IQR) anstelle von Mittelwert und Standardabweichung, was es robust gegenüber Ausreißern macht. Extremwerte beeinflussen diese Statistiken nicht signifikant, im Gegensatz zu StandardScaler oder MinMaxScaler, die stark durch Ausreißer verzerrt werden können. ## 19 weitere Fragen verfügbar - Was ist Label Encoding und wann ist es angemessen, es zu verwenden? - Welches Problem kann Target Encoding verursachen und wie kann man es vermeiden? Kostenlos registrieren: https://sharpskill.dev/de/login ## Weitere Data Science & ML-Interviewthemen - [Python-Grundlagen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/python-basics.md): 25 Fragen, Junior - [Python Objektorientierte Programmierung](https://sharpskill.dev/de/technologies/data-science/interviewfragen/python-oop.md): 20 Fragen, Junior - [Python-Datenstrukturen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/python-data-structures.md): 20 Fragen, Junior - [Git-Grundlagen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/git-fundamentals.md): 18 Fragen, Junior - [SQL-Grundlagen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/sql-basics.md): 20 Fragen, Junior - [NumPy-Grundlagen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/numpy-fundamentals.md): 22 Fragen, Junior - [Pandas-Grundlagen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/pandas-basics.md): 22 Fragen, Junior - [Jupyter & Google Colab](https://sharpskill.dev/de/technologies/data-science/interviewfragen/jupyter-colab.md): 16 Fragen, Junior - [SQL Joins & fortgeschrittene Abfragen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/sql-joins-advanced.md): 22 Fragen, Mid-Level - [Fortgeschrittenes Pandas](https://sharpskill.dev/de/technologies/data-science/interviewfragen/pandas-advanced.md): 24 Fragen, Mid-Level - [Visualisierung mit Matplotlib & Seaborn](https://sharpskill.dev/de/technologies/data-science/interviewfragen/matplotlib-seaborn.md): 20 Fragen, Mid-Level - [Interaktive Visualisierungen mit Plotly](https://sharpskill.dev/de/technologies/data-science/interviewfragen/plotly-interactive.md): 18 Fragen, Mid-Level - [Deskriptive Statistik](https://sharpskill.dev/de/technologies/data-science/interviewfragen/statistics-descriptive.md): 20 Fragen, Mid-Level - [Inferenzstatistik](https://sharpskill.dev/de/technologies/data-science/interviewfragen/statistics-inferential.md): 24 Fragen, Mid-Level - [Web Scraping](https://sharpskill.dev/de/technologies/data-science/interviewfragen/web-scraping.md): 18 Fragen, Mid-Level - [BigQuery & Cloud Data](https://sharpskill.dev/de/technologies/data-science/interviewfragen/bigquery-cloud.md): 18 Fragen, Mid-Level - [Überwachtes ML: Regression](https://sharpskill.dev/de/technologies/data-science/interviewfragen/ml-supervised-regression.md): 24 Fragen, Mid-Level - [Überwachtes ML: Klassifikation](https://sharpskill.dev/de/technologies/data-science/interviewfragen/ml-supervised-classification.md): 24 Fragen, Mid-Level - [Entscheidungsbäume & Ensembles](https://sharpskill.dev/de/technologies/data-science/interviewfragen/ml-trees-ensembles.md): 24 Fragen, Mid-Level - [Unüberwachtes ML](https://sharpskill.dev/de/technologies/data-science/interviewfragen/ml-unsupervised.md): 22 Fragen, Mid-Level - [ML-Pipelines & Validierung](https://sharpskill.dev/de/technologies/data-science/interviewfragen/ml-pipelines-validation.md): 22 Fragen, Mid-Level - [Zeitreihen & Prognosen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/time-series-forecasting.md): 22 Fragen, Mid-Level - [Grundlagen des Deep Learning](https://sharpskill.dev/de/technologies/data-science/interviewfragen/deep-learning-fundamentals.md): 24 Fragen, Senior - [TensorFlow & Keras](https://sharpskill.dev/de/technologies/data-science/interviewfragen/tensorflow-keras.md): 22 Fragen, Senior - [CNN und Bildklassifizierung](https://sharpskill.dev/de/technologies/data-science/interviewfragen/cnn-image-classification.md): 24 Fragen, Senior - [RNN & Sequenzen](https://sharpskill.dev/de/technologies/data-science/interviewfragen/rnn-sequences.md): 22 Fragen, Senior - [Transformers & Attention](https://sharpskill.dev/de/technologies/data-science/interviewfragen/transformers-attention.md): 24 Fragen, Senior - [NLP & Hugging Face](https://sharpskill.dev/de/technologies/data-science/interviewfragen/nlp-huggingface.md): 24 Fragen, Senior - [GenAI & LangChain](https://sharpskill.dev/de/technologies/data-science/interviewfragen/genai-langchain.md): 24 Fragen, Senior - [MLOps und Deployment](https://sharpskill.dev/de/technologies/data-science/interviewfragen/mlops-deployment.md): 24 Fragen, Senior --- Source: SharpSkill (https://sharpskill.dev), tech interview preparation for your real stack. HTML version of this page: https://sharpskill.dev/de/technologies/data-science/interviewfragen/feature-engineering