Топ-30 запитань на співбесіді HBase (2026)

Ось питання та відповіді на співбесіді з Apache HBase для нових і досвідчених кандидатів, щоб отримати роботу своєї мрії.

 

Запитання та відповіді на співбесіді HBase для першокурсників

1) Поясніть, що таке HBase?

HBase — це система керування базами даних, орієнтована на колонки, яка працює поверх HDFS (розповсюджуваної файлової системи Hadoop). HBase не є реляційним сховищем даних і не підтримує мову структурованих запитів, як-от SQL.

У HBase головний вузол регулює роботу кластерних і регіональних серверів для зберігання частин таблиць і керує роботою з даними.

👉 Безкоштовне завантаження у форматі PDF: HBase Interview Questions & Answers


2) Поясніть, навіщо використовувати HBase?

  • Система зберігання великої місткості
  • Розподілений дизайн для великих столів
  • Магазини, орієнтовані на колонки
  • Горизонтально масштабована
  • Висока продуктивність і доступність
  • Основною метою HBase є мільйони стовпців, тисячі версій і мільярди рядків
  • На відміну від HDFS (Hadoop Distribute File System), він підтримує випадкові операції CRUD у реальному часі

3) Згадайте, які ключові компоненти HBase?

Архітектура HBase в основному складається з наступних компонентів

  • Доглядач зоопарку: Він виконує координаційну роботу між клієнтом і HBase Maser
  • HBase Master: HBase Master контролює регіональний сервер
  • RegionServer: RegionServer стежить за регіоном
  • Регіон: Він містить у пам’яті сховище даних (MemStore) і Hfile.
  • Таблиці каталогу: Таблиці каталогу складаються з ROOT і META
HBase Archiдіаграма текстури
HBase Archiдіаграма текстури

4) Поясніть, з чого складається HBase?

  • HBase складається з набору таблиць
  • І кожна таблиця містить рядки та стовпці, як у традиційній базі даних
  • Кожна таблиця повинна містити елемент, визначений як первинний ключ
  • Стовпець HBase позначає атрибут об'єкта

5) Згадайте, скільки операційних команд у HBase?

В основному існує п'ять типів Operaнаціональний команди в HBase:

  • отримати
  • Ставити
  • видаляти
  • сканування
  • Збільшення
Питання для співбесіди HBase
Питання для співбесіди HBase

6) Поясніть, що таке WAL і Hlog у HBase?

WAL (Write Ahead Log) схожий на MySQL журнал БІН; він записує всі зміни, що відбуваються в даних. Це стандартний файл послідовності Hadoop і зберігає HLogkey. Ці ключі складаються з порядкового номера, а також фактичних даних і використовуються для відтворення ще не збережених даних після збою сервера. Таким чином, у випадку збою сервера WAL працює як рятувальний круг і відновлює втрачені дані.


7) Коли слід використовувати HBase?

  • Розмір даних величезний: Коли у вас є тонни і мільйони записів для роботи
  • Повний редизайн: Коли ви переносите RDBMS на HBase, ви розглядаєте це як повну оновлену конструкцію, ніж просто зміну портів
  • SQL-Less команди: У вас є кілька функцій, наприклад транзакції; внутрішні з'єднання, типізовані стовпці тощо.
  • Інвестиції в інфраструктуру: Вам потрібно мати достатньо кластерів, щоб HBase був дійсно корисним

8) Що таке сімейства стовпців у HBase?

Сімейства стовпців складають основну одиницю фізичної пам’яті в HBase, до якої застосовуються такі функції, як стиснення.


9) Поясніть, що таке ключ рядка?

Ключ рядка визначається застосунком. Оскільки комбінований ключ попередньо фіксується ключем рядка, це дозволяє застосунку визначити бажаний порядок сортування. Це також дозволяє логічне групування.ping комірок і переконайтеся, що всі комірки з однаковим ключем рядка розташовані на одному сервері.


10) Поясніть видалення в HBase? Згадайте, які є три типи маркерів надгробків у HBase?

Коли ви видаляєте клітинку в HBase, дані фактично не видаляються, але встановлюється маркер надгробка, що робить видалені клітинки невидимими. Видалені HBase фактично видаляються під час ущільнення.

Існує три типи маркерів надгробків:

  • Маркер видалення версії: для видалення позначає одну версію стовпця
  • Маркер видалення стовпця: для видалення він позначає всі версії стовпця
  • Маркер видалення сімейства: для видалення він позначає всі стовпці для сімейства стовпців

11) Поясніть, як HBase насправді видаляє рядок?

У HBase все, що ви записуєте, зберігатиметься з оперативної пам’яті на диск, ці записи на диск є незмінними, за винятком стиснення. Під час процесу видалення в HBase основний процес ущільнення видаляє маркер, тоді як другорядне ущільнення – ні. У звичайних видаленнях це призводить до появи маркера видалення надгробка — дані видалення, які вони представляють, видаляються під час стиснення.

Крім того, якщо ви видалите дані та додасте більше даних, але з більш ранньою міткою часу, ніж мітка часу надгробка, далі Отримує може бути замаскований маркером видалення/надгробної плити, тому ви не отримаєте вставлене значення до завершення основного ущільнення.


12) Поясніть, що станеться, якщо змінити розмір блоку сімейства стовпців у вже зайнятій базі даних?

Коли ви змінюєте розмір блоку сімейства стовпців, нові дані займають новий розмір блоку, тоді як старі дані залишаються в межах старого розміру блоку. Під час ущільнення даних старі дані отримають новий розмір блоку. Нові файли під час очищення мають новий розмір блоку, тоді як наявні дані читатимуться правильно. Усі дані мають бути перетворені до нового розміру блоку після наступного великого ущільнення.


13) Згадайте різницю між HBase та реляційною базою даних?

Ось деякі важливі відмінності між Apache HBase і реляційною базою даних:

HBase Реляційна база даних
  • Це без схем
  • Це сховище даних, орієнтоване на стовпці
  • Він використовується для зберігання денормалізованих даних
  • Він містить рідко заповнені таблиці
  • Автоматичне розбиття виконується в HBase
  • Це база даних на основі схеми
  • Це сховище даних, орієнтоване на рядки
  • Він використовується для зберігання нормалізованих даних
  • Він містить тонкі таблиці
  • Немає такого положення або вбудованої підтримки для розділення

14) Що таке клас HBaseFsck?

У HBase доступна функція зворотного виклику імені інструмента, яка реалізована класом HBaseFsck. Він пропонує кілька параметрів командного рядка, які впливають на його поведінку.


Запитання та відповіді на інтерв’ю HBase для досвідчених

15) Які основні ключові структури HBase?

Ключ рядка та ключ стовпця є двома найважливішими ключовими структурами, які використовуються в HBase


16) Обговоріть, як можна використовувати фільтри в Apache HBase

Фільтри в оболонці HBase. Його було представлено в Apache HBase 0.92, який допомагає вам виконувати фільтрацію на стороні сервера для доступу до HBase через HBase оболонка або ощадливість.


17) HBase підтримує синтаксичну структуру, наприклад SQL, так чи ні?

Ні, на жаль, SQL підтримка HBase наразі недоступна. Однак, використовуючи Apache Phoenix, ми можемо отримувати дані з HBase через запити SQL.


18) Що означає стиснення в HBase?

Під час великої кількості вхідних записів неможливо досягти оптимальної продуктивності, маючи один файл на сховище. HBase допомагає вам об’єднати всі ці файли HFiles, щоб зменшити кількість завантажень диска для кожного читання. Цей процес відомий як ущільнення в HBase.


19) Як ви реалізуєте об’єднання в HBase?

HBase, не підтримує приєднання безпосередньо, але використовує MapReduce Запити на об’єднання завдань можуть бути реалізовані шляхом отримання даних за допомогою різних таблиць HBase.


20) Поясніть JMX щодо HBSE

Java Розширення керування або JMX є статусом експорту Java програми є стандартом для них.


21) Яка користь від MasterServer?

Головний сервер також допоможе вам призначити регіон регіональному серверу. Це також допомагає вам керувати балансуванням навантаження, яке ми використовуємо на MasterServer.


22) Дайте визначення терміну ощадливість

Написано Apache Thrift C++. Він надає компілятори схем для різних мов програмування, наприклад C++, Perl, PHP, Python, Ruby тощо.


23) Навіщо використовувати HColumnDescriptчи клас?

Подробиці щодо сімейства стовпців, наприклад параметри стиснення, кількість версій, зберігаються в HColumnDescriptабо.


24) Що таке комірка в HBase?

Комірка в HBase є найменшою одиницею Таблиця HBase. Це допомагає вам зберігати частину даних у формі кортежу {рядка, стовпця, версії}


25) Що таке фільтр Блума?

HBase підтримує фільтр Bloom, який допомагає вам покращити загальну пропускну здатність кластера. Фільтр Bloom HBase — це ефективний механізм для перевірки того, чи HFile містить певну комірку рядка або стовпця рядка.


26) Розкажіть мені про типи HBase Operaції?

Відповідь Два типи HBase Operaції є:

  • Читати Operaції
  • Запис Operaції

27) Для чого корисний HBase HMaster?

Основними обов'язками майстра є:

  1. Координація серверів регіону
  2. Функції адміністратора

28) Яку техніку можна використовувати в HBase для прямого доступу до HFile без допомоги HBase?

Для прямого доступу до HFile без використання HBase ми використовуємо метод HFile.main().


29) Чи може регіональний сервер розташовуватися на всіх DataNodes?

Так, регіональні сервери працюють на тих самих серверах, що й DataNodes


30) Назвіть фільтр, який приймає розмір сторінки як параметр у HBase

Фільтр під назвою PageFilter приймає розмір сторінки як параметр.

Цей документ було створено за допомогою інструментів миттєвого конвертування HTML.

Ці запитання для співбесіди також допоможуть вам у життєдіяльності (усному)

Підсумуйте цей пост за допомогою: