# Apache Beam & Dataflow (Data Engineering) > PCollections, Transforms (ParDo, GroupByKey), Windowing, Triggers, Watermarks, Dataflow Runner, Autoscaling, Templates - 20 Interview-Fragen - Senior - [Interview-Fragen: Data Engineering](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen.md) ## 1. Was ist eine PCollection in Apache Beam? **Antwort** Eine PCollection ist die primäre Datenabstraktion in Apache Beam. Sie repräsentiert einen verteilten, potenziell unbegrenzten Datensatz, der parallel verarbeitet werden kann. Im Gegensatz zu regulären Collections ist eine PCollection unveränderlich, was bedeutet, dass jeder Transform eine neue PCollection erstellt, anstatt das Original zu modifizieren. ## 2. Was ist der Hauptunterschied zwischen einer bounded und unbounded PCollection? **Antwort** Eine bounded PCollection hat eine endliche, bekannte Größe (wie eine Datei oder Tabelle), während eine unbounded einen potenziell unendlichen Datenstrom (wie Streaming-Events) repräsentiert. Diese Unterscheidung beeinflusst, wie Beam Daten verarbeitet: bounded verwendet klassische Batch-Verarbeitung, während unbounded Windowing und Triggers benötigt, um den kontinuierlichen Fluss zu handhaben. ## 3. Welche Rolle spielt die ParDo-Transformation in Apache Beam? **Antwort** ParDo (Parallel Do) ist die flexibelste Transformation in Apache Beam. Sie wendet eine benutzerdefinierte Funktion (DoFn) parallel auf jedes Element einer PCollection an. ParDo kann null, ein oder mehrere Ausgabeelemente für jedes Eingabeelement erzeugen, was sie für Filtering, Mapping und Flat-Mapping geeignet macht. ## 17 weitere Fragen verfügbar - Wie verwendet man Side Inputs in einer ParDo-Transformation? - Was ist der Unterschied zwischen GroupByKey und CoGroupByKey in Apache Beam? Kostenlos registrieren: https://sharpskill.dev/de/login ## Weitere Data Engineering-Interviewthemen - [Linux & Shell - Grundlagen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/linux-shell-basics.md): 20 Fragen, Junior - [Git & GitHub - Grundlagen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/git-github-fundamentals.md): 20 Fragen, Junior - [Fortgeschrittenes Python für Data Engineering](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/python-advanced-de.md): 25 Fragen, Junior - [Docker - Grundlagen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/docker-fundamentals.md): 25 Fragen, Junior - [Google Cloud Platform - Grundlagen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/gcp-fundamentals.md): 20 Fragen, Junior - [CI/CD und Codequalität](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/ci-cd-code-quality.md): 20 Fragen, Mid-Level - [Docker Compose](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/docker-compose.md): 20 Fragen, Mid-Level - [FastAPI - Daten-APIs](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/fastapi.md): 20 Fragen, Mid-Level - [Fortgeschrittenes SQL für Data Engineering](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/sql-advanced-de.md): 20 Fragen, Mid-Level - [Data Lake - Architektur und Ingestion](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/data-lake.md): 20 Fragen, Mid-Level - [BigQuery für Data Engineering](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/bigquery-de.md): 20 Fragen, Mid-Level - [PostgreSQL - Administration](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/postgresql-admin.md): 20 Fragen, Mid-Level - [Data Modeling für Data Engineering](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/data-modeling-de.md): 20 Fragen, Mid-Level - [Fivetran & Airbyte - Daten-Ingestion](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/fivetran-airbyte.md): 20 Fragen, Mid-Level - [dbt - Grundlagen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/dbt-fundamentals-de.md): 20 Fragen, Mid-Level - [Apache Airflow - Grundlagen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/airflow-fundamentals.md): 20 Fragen, Mid-Level - [Kubernetes - Grundlagen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/kubernetes-fundamentals.md): 20 Fragen, Mid-Level - [dbt - Erweiterte Funktionen](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/dbt-advanced-de.md): 20 Fragen, Senior - [ETL- / ELT- / ETLT-Patterns](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/etl-elt-patterns.md): 20 Fragen, Senior - [Apache Airflow - Fortgeschritten](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/airflow-advanced.md): 20 Fragen, Senior - [Airflow + dbt - Pipeline-Orchestrierung](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/airflow-dbt-integration.md): 20 Fragen, Senior - [PySpark - Verarbeitung im großen Maßstab](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/pyspark.md): 20 Fragen, Senior - [Google Pub/Sub - Daten-Streaming](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/pubsub-streaming.md): 20 Fragen, Senior - [Kubernetes - Produktion und Skalierung](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/kubernetes-advanced.md): 20 Fragen, Senior - [Terraform - Infrastructure as Code](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/terraform.md): 20 Fragen, Senior - [NoSQL-Datenbanken](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/nosql-databases.md): 20 Fragen, Senior - [Moderne Data Architecture](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/data-architecture.md): 20 Fragen, Senior - [Monitoring und Observability](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/monitoring-observability.md): 20 Fragen, Senior - [IAM und Datensicherheit](https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/iam-security-de.md): 20 Fragen, Senior --- Source: SharpSkill (https://sharpskill.dev), tech interview preparation for your real stack. HTML version of this page: https://sharpskill.dev/de/technologies/data-engineering/interviewfragen/apache-beam-dataflow