Configuração
ipython para executar os comandos no restante do guia, que pode ser iniciado com:
Consultando um arquivo JSON no S3
Configurando o formato de saída
CSV, mas podemos alterá-lo por meio do parâmetro output_format.
O chDB oferece suporte aos formatos de dados do ClickHouse, bem como a alguns formatos próprios, incluindo DataFrame, que retorna um DataFrame do pandas:
Criando uma tabela a partir de um arquivo JSON
O chDB executa um único engine embutido por processo; portanto, o diretório do banco de dados (seu caminho) segue algumas regras:
- Um processo por caminho: um diretório de dados do chDB pode ser aberto por apenas um processo do sistema operacional por vez. Um segundo processo que tentar abrir o mesmo caminho falhará até que o primeiro seja fechado.
- Um caminho por processo: enquanto uma sessão ou conexão estiver aberta, abrir outra para um caminho diferente falhará; primeiro feche a(s) sessão(ões) ou conexão(ões) abertas para evitar o erro. Várias sessões ou conexões no mesmo caminho podem coexistir.
- Concorrência: sessões ou conexões no mesmo caminho podem executar consultas simultaneamente.
- Sessões sem caminho são compartilhadas: sem um caminho, as sessões usam o banco de dados
:memory:de todo o processo (portanto, sessões sem caminho veem as tabelas umas das outras), e seu diretório temporário é removido somente quando a última é fechada.
dislikes com base no schema do arquivo JSON, usando a técnica CREATE...EMPTY AS.
Usaremos a configuração schema_inference_make_columns_nullable para que os tipos de coluna não sejam todos convertidos em Nullable.
DESCRIBE para inspecionar o schema:
CREATE...AS.
Vamos criar outra tabela usando essa técnica: