A integração com o catálogo REST funciona apenas com tabelas Iceberg.
Esta integração oferece suporte tanto ao S3 da AWS quanto a outros provedores de armazenamento em nuvem.
- Ambientes locais de desenvolvimento (usando configurações com docker-compose)
- Serviços gerenciados como o Tabular.io
- Implementações self-hosted de catálogo REST
Como este recurso está em beta, você precisará habilitá-lo com:
SET allow_database_iceberg = 1;Configuração de desenvolvimento local
Pré-requisitos
- Docker e Docker Compose: Certifique-se de que o Docker esteja instalado e em execução
- Configuração de exemplo: Você pode usar diferentes configurações do
docker-compose(veja as imagens Docker alternativas abaixo)
Configurando o catálogo REST local
docker-compose.yml com a configuração do Databricks docker-spark-iceberg.
Etapa 2: Em seguida, crie um arquivo docker-compose.override.yml e adicione a ele a seguinte configuração de contêiner do ClickHouse:
A configuração do catálogo REST exige que os dados de exemplo sejam carregados primeiro nas tabelas Iceberg. Certifique-se de que o ambiente do Spark tenha criado e populado as tabelas antes de tentar fazer consultas nelas por meio do ClickHouse. A disponibilidade das tabelas depende da configuração específica do docker-compose e dos scripts de carregamento dos dados de exemplo.
Conectando-se ao Catálogo REST local
Consultando tabelas do catálogo REST com o ClickHouse
Se você não vir nenhuma tabela, isso geralmente significa que:
- O ambiente Spark ainda não criou as tabelas de exemplo
- O serviço de catálogo REST ainda não foi totalmente inicializado
- O processo de carregamento dos dados de exemplo ainda não foi concluído
Backticks obrigatóriosOs backticks são obrigatórios porque o ClickHouse não oferece suporte a mais de um espaço de nomes.
Carregando dados do seu lago de dados para o ClickHouse
INSERT INTO SELECT: