Встречается на собеседованиях • сегодня
Работал ли с Apache Spark
Да, работал. Использовал PySpark для обработки больших данных, включая агрегации, фильтрацию и ML-задачи. Например, для обучения модели логистической регрессии:
python
from pyspark.sql import SparkSession
from pyspark.ml.classification import LogisticRegression
spark = SparkSession.builder.appName("LR").getOrCreate()
data = spark.read.csv("data.csv", header=True, inferSchema=True)
lr = LogisticRegression(featuresCol="features", labelCol="label")
model = lr.fit(data)
text
Оптимизировал производительность через `repartition()`, `cache()` и настройку параметров Spark. Работал с RDD и DataFrame API, включая SQL-запросы через `spark.sql()`.
Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
офферы быстрее!
Попробовать бесплатно
Следующий вопрос
Это единственный вопрос по вашему фильтру
как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы