Встречается на собеседованиях • сегодня
Был ли опыт работы с Spark
Да, работал с Apache Spark для обработки больших данных. Использовал PySpark для ETL, агрегаций и ML.
Пример:
python
from pyspark.sql import SparkSession
spark = SparkSession.builder.appName("example").getOrCreate()
df = spark.read.csv("data.csv", header=True)
df_filtered = df.filter(df["age"] > 30)
df_grouped = df_filtered.groupBy("department").count()
df_grouped.show()
text
Основные моменты:
- Оптимизация через `partitionBy`, `cache()`
- Работа с `DataFrame API` и SQL-синтаксисом
- Настройка ресурсов через `spark-submit` (executors, memory)
- Опыт с `Spark Streaming` для near-real-time обработки
Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
офферы быстрее!
Попробовать бесплатно
Следующий вопрос
Это единственный вопрос по вашему фильтру
как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы