Банк вопросов

Вопросы по Apache Spark с ответами

Практический набор для самопроверки и подготовки к интервью. Ответы раскрываются вместе с объяснением.

Пройти полноценный тест
1Какое описание лучше всего соответствует «Apache Spark»?
Ответ: распределенный движок обработки больших данных

«Apache Spark» — распределенный движок обработки больших данных.

2Какая технология описывается так: «распределенный движок обработки больших данных»?
Ответ: Apache Spark

Описание относится к «Apache Spark».

3Верно ли утверждение: «Apache Spark — распределенный движок обработки больших данных»?
Ответ: Верно

Утверждение верно: распределенный движок обработки больших данных.

4Верно ли утверждение: «Apache Spark — протокол двунаправленного постоянного соединения между клиентом и сервером поверх одного TCP-соединения»?
Ответ: Неверно

Утверждение неверно. «Apache Spark» — распределенный движок обработки больших данных.

5Какое утверждение о «Apache Spark» наиболее точное?
Ответ: Это тема из области «Data, Analytics и BI» и ее назначение связано с тем, что распределенный движок обработки больших данных

В ITQuiz «Apache Spark» относится к разделу «Data, Analytics и BI»; распределенный движок обработки больших данных.

6Какая статистическая мера обычно устойчивее среднего к единичным сильным выбросам?
Ответ: Медиана

Медиана зависит от положения значений в упорядоченном ряду и обычно меньше реагирует на выбросы.

7Что означает выражение «корреляция не равна причинности»?
Ответ: Совместное изменение показателей само по себе не доказывает причинную связь

Наблюдаемая связь может возникать из-за смешивающих факторов, обратной причинности или совпадения.

8Что обозначает ETL?
Ответ: Извлечение, преобразование и загрузку данных

ETL расшифровывается как Extract, Transform, Load.

9Зачем аналитике визуализация данных?
Ответ: Чтобы быстрее замечать закономерности, сравнения и аномалии при корректном выборе графика

Графики помогают интерпретации, но не заменяют качество данных и корректный анализ.

10К какому крупному направлению знаний относится «Apache Spark»?
Ответ: Data, Analytics и BI

В структуре ITQuiz «Apache Spark» относится к разделу «Data, Analytics и BI».

11Какая тема находится с «Apache Spark» в одном направлении «Data, Analytics и BI»?
Ответ: Hadoop

«Hadoop» и «Apache Spark» находятся в одном направлении «Data, Analytics и BI».

12Что НЕ относится к тому же направлению, что и «Apache Spark»?
Ответ: Directus

«Directus» относится к разделу «CMS, e-commerce и Low-code», а остальные варианты — к «Data, Analytics и BI».

13Проверьте фундамент, связанный с темой «Apache Spark»: Какая статистическая мера обычно устойчивее среднего к единичным сильным выбросам?
Ответ: Медиана

Медиана зависит от положения значений в упорядоченном ряду и обычно меньше реагирует на выбросы.

14Проверьте фундамент, связанный с темой «Apache Spark»: Что означает выражение «корреляция не равна причинности»?
Ответ: Совместное изменение показателей само по себе не доказывает причинную связь

Наблюдаемая связь может возникать из-за смешивающих факторов, обратной причинности или совпадения.

15Проверьте фундамент, связанный с темой «Apache Spark»: Что обозначает ETL?
Ответ: Извлечение, преобразование и загрузку данных

ETL расшифровывается как Extract, Transform, Load.

16Проверьте фундамент, связанный с темой «Apache Spark»: Зачем аналитике визуализация данных?
Ответ: Чтобы быстрее замечать закономерности, сравнения и аномалии при корректном выборе графика

Графики помогают интерпретации, но не заменяют качество данных и корректный анализ.

17Для уверенного понимания «Apache Spark» важно знать базу раздела «Data, Analytics и BI». Какая статистическая мера обычно устойчивее среднего к единичным сильным выбросам?
Ответ: Медиана

Медиана зависит от положения значений в упорядоченном ряду и обычно меньше реагирует на выбросы.

18Для уверенного понимания «Apache Spark» важно знать базу раздела «Data, Analytics и BI». Что означает выражение «корреляция не равна причинности»?
Ответ: Совместное изменение показателей само по себе не доказывает причинную связь

Наблюдаемая связь может возникать из-за смешивающих факторов, обратной причинности или совпадения.

19Для уверенного понимания «Apache Spark» важно знать базу раздела «Data, Analytics и BI». Что обозначает ETL?
Ответ: Извлечение, преобразование и загрузку данных

ETL расшифровывается как Extract, Transform, Load.

20Для уверенного понимания «Apache Spark» важно знать базу раздела «Data, Analytics и BI». Зачем аналитике визуализация данных?
Ответ: Чтобы быстрее замечать закономерности, сравнения и аномалии при корректном выборе графика

Графики помогают интерпретации, но не заменяют качество данных и корректный анализ.

Тесты по Apache Spark