Перейти к основному содержимому
Перейти к основному содержимому

Внешние данные для обработки запросов

ClickHouse позволяет отправлять серверу данные, необходимые для обработки запроса, вместе с запросом SELECT. Эти данные помещаются во временную таблицу (см. раздел "Временные таблицы") и могут быть использованы в запросе (например, в операторах IN).

Например, если у вас есть текстовый файл с важными идентификаторами пользователей, вы можете загрузить его на сервер вместе с запросом, который использует фильтрацию по этому списку.

Если вам нужно выполнить больше одного запроса с большим объемом внешних данных, не используйте эту возможность. Лучше загрузить данные в базу данных заранее.

Внешние данные могут быть загружены с помощью клиентской программы командной строки (в неинтерактивном режиме) или через HTTP-интерфейс.

В клиенте командной строки вы можете указать секцию параметров в формате

Вы можете иметь несколько таких секций в зависимости от количества передаваемых таблиц.

–external – Помечает начало условия.
–file – Путь к файлу с дампом таблицы или - , что указывает на stdin.
Только одна таблица может быть получена из stdin.

Следующие параметры являются необязательными: –name – Имя таблицы. Если опущено, используется _data.
–format – Формат данных в файле. Если опущено, используется TabSeparated.

Один из следующих параметров обязателен:–types – Список типов колонок, разделенных запятыми. Например: UInt64,String. Столбцы будут названы _1, _2, ...
–structure – Структура таблицы в формате UserID UInt64, URL String. Определяет имена и типы колонок.

Файлы, указанные в 'file', будут анализироваться в формате, указанном в 'format', с использованием типов данных, указанных в 'types' или 'structure'. Таблица будет загружена на сервер и будет доступна там как временная таблица с именем, указанным в 'name'.

Примеры:

При использовании HTTP-интерфейса внешние данные передаются в формате multipart/form-data. Каждая таблица передается как отдельный файл. Имя таблицы берется из имени файла. Параметр query_string передает параметры name_format, name_types и name_structure, где name – это имя таблицы, к которой соответствуют эти параметры. Значение параметров такое же, как и при использовании клиентской программы командной строки.

Пример:

Для распределенной обработки запросов временные таблицы передаются на все удаленные серверы.