Встречается на собеседованиях • сегодня

Работал ли с Hadoop

Да, работал с Hadoop, в основном с HDFS и MapReduce. Использовал PySpark для обработки больших данных, так как он удобнее для Data Science задач.

Пример чтения данных из HDFS в PySpark:

python
from pyspark.sql import SparkSession

spark = SparkSession.builder.appName("HadoopExample").getOrCreate()
df = spark.read.csv("hdfs://path/to/file.csv", header=True)
df.show()

text

Также знаком с Hive для SQL-запросов и YARN для управления ресурсами. Hadoop полезен при работе с очень большими объемами данных, но для многих задач сейчас предпочитаю облачные решения (BigQuery, S3 + Spark).
Sophi
Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
Попробовать бесплатноArrow

Следующий вопрос

Это единственный вопрос по вашему фильтру

как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы