Учебники

HiveQL — Select-Joins

JOIN — это предложение, которое используется для объединения определенных полей из двух таблиц с использованием значений, общих для каждой из них. Он используется для объединения записей из двух или более таблиц в базе данных.

Синтаксис

join_table:

   table_reference JOIN table_factor [join_condition]
   | table_reference {LEFT|RIGHT|FULL} [OUTER] JOIN table_reference
   join_condition
   | table_reference LEFT SEMI JOIN table_reference join_condition
   | table_reference CROSS JOIN table_reference [join_condition]

пример

Мы будем использовать следующие две таблицы в этой главе. Рассмотрим следующую таблицу с именем CUSTOMERS.

+----+----------+-----+-----------+----------+ 
| ID | NAME     | AGE | ADDRESS   | SALARY   | 
+----+----------+-----+-----------+----------+ 
| 1  | Ramesh   | 32  | Ahmedabad | 2000.00  |  
| 2  | Khilan   | 25  | Delhi     | 1500.00  |  
| 3  | kaushik  | 23  | Kota      | 2000.00  | 
| 4  | Chaitali | 25  | Mumbai    | 6500.00  | 
| 5  | Hardik   | 27  | Bhopal    | 8500.00  | 
| 6  | Komal    | 22  | MP        | 4500.00  | 
| 7  | Muffy    | 24  | Indore    | 10000.00 | 
+----+----------+-----+-----------+----------+

Рассмотрим другую таблицу ORDERS следующим образом:

+-----+---------------------+-------------+--------+ 
|OID  | DATE                | CUSTOMER_ID | AMOUNT | 
+-----+---------------------+-------------+--------+ 
| 102 | 2009-10-08 00:00:00 |           3 | 3000   | 
| 100 | 2009-10-08 00:00:00 |           3 | 1500   | 
| 101 | 2009-11-20 00:00:00 |           2 | 1560   | 
| 103 | 2008-05-20 00:00:00 |           4 | 2060   | 
+-----+---------------------+-------------+--------+

Существуют различные типы соединений, представленные следующим образом:

  • ПРИСОЕДИНИТЬСЯ
  • ЛЕВОЕ НАРУЖНОЕ СОЕДИНЕНИЕ
  • ПРАВО НАРУЖНОЕ СОЕДИНЕНИЕ
  • ПОЛНОЕ НАРУЖНОЕ СОЕДИНЕНИЕ

ПРИСОЕДИНИТЬСЯ

Предложение JOIN используется для объединения и извлечения записей из нескольких таблиц. JOIN аналогичен OUTER JOIN в SQL. Условие JOIN должно быть создано с использованием первичных ключей и внешних ключей таблиц.

Следующий запрос выполняет JOIN для таблиц CUSTOMER и ORDER и извлекает записи:

hive> SELECT c.ID, c.NAME, c.AGE, o.AMOUNT 
FROM CUSTOMERS c JOIN ORDERS o 
ON (c.ID = o.CUSTOMER_ID);

При успешном выполнении запроса вы увидите следующий ответ:

+----+----------+-----+--------+ 
| ID | NAME     | AGE | AMOUNT | 
+----+----------+-----+--------+ 
| 3  | kaushik  | 23  | 3000   | 
| 3  | kaushik  | 23  | 1500   | 
| 2  | Khilan   | 25  | 1560   | 
| 4  | Chaitali | 25  | 2060   | 
+----+----------+-----+--------+

ЛЕВОЕ НАРУЖНОЕ СОЕДИНЕНИЕ

HiveQL LEFT OUTER JOIN возвращает все строки из левой таблицы, даже если в правой таблице нет совпадений. Это означает, что если предложение ON соответствует 0 (нулю) записей в правой таблице, JOIN по-прежнему возвращает строку в результате, но с NULL в каждом столбце из правой таблицы.

LEFT JOIN возвращает все значения из левой таблицы, а также совпадающие значения из правой таблицы или NULL в случае отсутствия соответствующего предиката JOIN.

Следующий запрос демонстрирует LEFT OUTER JOIN между таблицами CUSTOMER и ORDER:

hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE 
FROM CUSTOMERS c 
LEFT OUTER JOIN ORDERS o 
ON (c.ID = o.CUSTOMER_ID);

При успешном выполнении запроса вы увидите следующий ответ:

+----+----------+--------+---------------------+ 
| ID | NAME     | AMOUNT | DATE                | 
+----+----------+--------+---------------------+ 
| 1  | Ramesh   | NULL   | NULL                | 
| 2  | Khilan   | 1560   | 2009-11-20 00:00:00 | 
| 3  | kaushik  | 3000   | 2009-10-08 00:00:00 | 
| 3  | kaushik  | 1500   | 2009-10-08 00:00:00 | 
| 4  | Chaitali | 2060   | 2008-05-20 00:00:00 | 
| 5  | Hardik   | NULL   | NULL                | 
| 6  | Komal    | NULL   | NULL                | 
| 7  | Muffy    | NULL   | NULL                | 
+----+----------+--------+---------------------+

ПРАВО НАРУЖНОЕ СОЕДИНЕНИЕ

HiveQL RIGHT OUTER JOIN возвращает все строки из правой таблицы, даже если в левой таблице нет совпадений. Если предложение ON соответствует 0 (нулю) записей в левой таблице, JOIN по-прежнему возвращает строку в результате, но с NULL в каждом столбце левой таблицы.

RIGHT JOIN возвращает все значения из правой таблицы, а также совпадающие значения из левой таблицы или NULL в случае отсутствия соответствующего предиката соединения.

Следующий запрос демонстрирует ПРАВИЛЬНОЕ НАРУЖНОЕ СОЕДИНЕНИЕ между таблицами CUSTOMER и ORDER.

notranslate «> hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE ОТ КЛИЕНТОВ c ПРАВИЛЬНО НАРУЖНЫЕ ЗАКАЗЫ СОЕДИНЕНИЯ o ON (c.ID = o.CUSTOMER_ID);

При успешном выполнении запроса вы увидите следующий ответ:

+------+----------+--------+---------------------+ 
| ID   | NAME     | AMOUNT | DATE                | 
+------+----------+--------+---------------------+ 
| 3    | kaushik  | 3000   | 2009-10-08 00:00:00 | 
| 3    | kaushik  | 1500   | 2009-10-08 00:00:00 | 
| 2    | Khilan   | 1560   | 2009-11-20 00:00:00 | 
| 4    | Chaitali | 2060   | 2008-05-20 00:00:00 | 
+------+----------+--------+---------------------+

ПОЛНОЕ НАРУЖНОЕ СОЕДИНЕНИЕ

HiveQL FULL OUTER JOIN объединяет записи как левой, так и правой внешних таблиц, которые удовлетворяют условию JOIN. Объединенная таблица содержит либо все записи из обеих таблиц, либо заполняет значения NULL для пропущенных совпадений с обеих сторон.

Следующий запрос демонстрирует FULL OUTER JOIN между таблицами CUSTOMER и ORDER:

hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE 
FROM CUSTOMERS c 
FULL OUTER JOIN ORDERS o 
ON (c.ID = o.CUSTOMER_ID);

При успешном выполнении запроса вы увидите следующий ответ: