# Apache Beam & Dataflow (Data Engineering) > PCollections, transforms (ParDo, GroupByKey), windowing, triggers, watermarks, Dataflow runner, autoscaling, templates - 20 domande da colloquio - Senior - [Domande da colloquio: Data Engineering](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio.md) ## 1. Cos'è una PCollection in Apache Beam? **Risposta** Una PCollection è l'astrazione dati principale in Apache Beam. Rappresenta un dataset distribuito e potenzialmente illimitato che può essere elaborato in parallelo. A differenza delle collection regolari, una PCollection è immutabile, il che significa che ogni transform crea una nuova PCollection invece di modificare l'originale. ## 2. Qual è la differenza principale tra una PCollection bounded e unbounded? **Risposta** Una PCollection bounded ha una dimensione finita e nota (come un file o una tabella), mentre una unbounded rappresenta un flusso di dati potenzialmente infinito (come eventi in streaming). Questa distinzione influisce sul modo in cui Beam elabora i dati: bounded usa l'elaborazione batch classica, mentre unbounded richiede windowing e trigger per gestire il flusso continuo. ## 3. Qual è il ruolo della trasformazione ParDo in Apache Beam? **Risposta** ParDo (Parallel Do) è la trasformazione più flessibile in Apache Beam. Applica una funzione definita dall'utente (DoFn) a ciascun elemento di una PCollection in parallelo. ParDo può produrre zero, uno o più elementi di output per ogni elemento di input, rendendola adatta per filtering, mapping e flat-mapping. ## Altre 17 domande disponibili - Come usare i side input in una trasformazione ParDo? - Qual è la differenza tra GroupByKey e CoGroupByKey in Apache Beam? Registrati gratis: https://sharpskill.dev/it/login ## Altri argomenti di colloquio Data Engineering - [Linux & Shell - Fondamenti](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/linux-shell-basics.md): 20 domande, Junior - [Git & GitHub - Fondamenti](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/git-github-fundamentals.md): 20 domande, Junior - [Python avanzato per Data Engineering](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/python-advanced-de.md): 25 domande, Junior - [Docker - Fondamenti](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/docker-fundamentals.md): 25 domande, Junior - [Google Cloud Platform - Fondamenti](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/gcp-fundamentals.md): 20 domande, Junior - [CI/CD e qualità del codice](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/ci-cd-code-quality.md): 20 domande, Mid-Level - [Docker Compose](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/docker-compose.md): 20 domande, Mid-Level - [FastAPI - API per dati](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/fastapi.md): 20 domande, Mid-Level - [SQL avanzato per il Data Engineering](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/sql-advanced-de.md): 20 domande, Mid-Level - [Data Lake - Architettura e ingestione](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/data-lake.md): 20 domande, Mid-Level - [BigQuery per il Data Engineering](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/bigquery-de.md): 20 domande, Mid-Level - [PostgreSQL - Amministrazione](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/postgresql-admin.md): 20 domande, Mid-Level - [Data Modeling per Data Engineering](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/data-modeling-de.md): 20 domande, Mid-Level - [Fivetran & Airbyte - Ingestione dati](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/fivetran-airbyte.md): 20 domande, Mid-Level - [dbt - Fondamenti](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/dbt-fundamentals-de.md): 20 domande, Mid-Level - [Apache Airflow - Fondamenti](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/airflow-fundamentals.md): 20 domande, Mid-Level - [Kubernetes - Fondamenti](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/kubernetes-fundamentals.md): 20 domande, Mid-Level - [dbt - Funzionalità avanzate](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/dbt-advanced-de.md): 20 domande, Senior - [Pattern ETL / ELT / ETLT](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/etl-elt-patterns.md): 20 domande, Senior - [Apache Airflow - Avanzato](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/airflow-advanced.md): 20 domande, Senior - [Airflow + dbt - Orchestrazione delle pipeline](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/airflow-dbt-integration.md): 20 domande, Senior - [PySpark - Elaborazione su larga scala](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/pyspark.md): 20 domande, Senior - [Google Pub/Sub - Streaming di dati](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/pubsub-streaming.md): 20 domande, Senior - [Kubernetes - Produzione e scaling](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/kubernetes-advanced.md): 20 domande, Senior - [Terraform - Infrastructure as Code](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/terraform.md): 20 domande, Senior - [Database NoSQL](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/nosql-databases.md): 20 domande, Senior - [Data Architecture moderna](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/data-architecture.md): 20 domande, Senior - [Monitoraggio e osservabilità](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/monitoring-observability.md): 20 domande, Senior - [IAM e sicurezza dei dati](https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/iam-security-de.md): 20 domande, Senior --- Source: SharpSkill (https://sharpskill.dev), tech interview preparation for your real stack. HTML version of this page: https://sharpskill.dev/it/technologies/data-engineering/domande-colloquio/apache-beam-dataflow