Skip to main content
Essas configurações estão disponíveis em system.settings e são autogeradas a partir do código-fonte.

ai_function_allow_insecure_endpoint

Se false (padrão), as funções de IA se recusam a usar um endpoint de coleção nomeada que enviaria prompts e chaves de API por uma conexão não criptografada a um host remoto: qualquer endpoint não HTTPS cujo host não seja de loopback é rejeitado com uma exceção. Endpoints de loopback (por exemplo, um servidor de modelo local em http://localhost) são sempre permitidos. Defina como true para permitir endpoints http:// em texto simples em hosts remotos.

ai_function_embedding_default_credentials

Nome da coleção nomeada usada pelas funções de embedding (aiEmbed, aiSimilarity) quando a chamada não fornece credentials no mapa de parâmetros. Vazio significa que não há valor padrão: essas chamadas devem fornecer credentials explicitamente. Essas funções usam model como argumento posicional obrigatório, e não a partir da coleção nomeada. Isso é mantido separado de ai_function_text_default_credentials porque um endpoint de embeddings é diferente de um endpoint de chat.

ai_function_embedding_max_batch_size

Número máximo de textos a serem incluídos em uma única requisição HTTP feita pelas funções de embedding (aiEmbed, aiSimilarity). Os textos são agrupados em lotes desse tamanho para reduzir a sobrecarga das chamadas de API. Por exemplo, 500 textos únicos com lote de 100 resultam em 5 requisições HTTP.

ai_function_max_api_calls_per_query

Número máximo de requisições HTTP que as funções de IA podem encaminhar em uma consulta. Aplicado independentemente por cada servidor e fragmento de consulta: em um contexto de execução, é um limite exato compartilhado por todas as funções de IA, blocos e threads nele, mas uma consulta distribuída (entre shards ou fragmentos de réplicas paralelas) pode encaminhar até esse número de requisições por shard/fragmento. Deve ser definido na consulta de nível superior — uma substituição de SETTINGS em uma subconsulta é ignorada. Defina como 0 para desabilitar.

ai_function_max_input_tokens_per_query

Número máximo total de tokens de entrada (prompt) em todas as chamadas de API da função de IA em uma única consulta. O total é contabilizado de forma cumulativa com base nas respostas dos provedores. Observe que esse limite pode ser excedido pelo volume de tokens de entrada de até uma chamada por solicitação em andamento, já que os tokens de entrada de uma chamada não são conhecidos até que sua resposta chegue. Assim como as outras cotas de IA, ele é aplicado por servidor / fragmento de consulta, não sendo somado em uma consulta distribuída, e deve ser definido na consulta de nível superior — uma substituição de SETTINGS em uma subconsulta é ignorada. Defina como 0 para desativar. Esse limite só é aplicado a provedores que informam um objeto usage na resposta (OpenAI, Anthropic, vLLM). Provedores que omitem o uso de tokens (principalmente o HuggingFace TEI) fazem com que o contador permaneça em 0 — use ai_function_max_api_calls_per_query para limitar essas chamadas.

ai_function_max_output_tokens_per_query

Máximo total de tokens de saída (completion) em todas as chamadas de API da função de IA em uma única consulta. O rastreamento é cumulativo com base nas respostas do provedor. Observe que esse limite pode ser excedido em até o volume de tokens de saída de uma chamada por solicitação em andamento, já que os tokens de saída de uma chamada não são conhecidos até a chegada da resposta. Assim como as outras cotas de IA, ele é aplicado por servidor / fragmento de consulta, não sendo somado em uma consulta distribuída, e deve ser definido na consulta de nível superior — uma substituição de SETTINGS em uma subconsulta é ignorada. Defina como 0 para desativar. Esse limite só é aplicado a provedores que informam um objeto usage na resposta (OpenAI, Anthropic, vLLM). Ele não se aplica às funções de embedding (aiEmbed, aiSimilarity), que nunca produzem tokens de saída.

ai_function_max_retries

Número máximo de retentativas para erros transitórios por solicitação individual à API. Cada retentativa usa backoff exponencial a partir de ai_function_retry_initial_delay_ms.

ai_function_request_timeout_sec

Timeout em segundos para requisições HTTP individuais feitas por funções de IA (completions de chat com IA e chamadas à API de embedding). Se uma requisição não for concluída dentro desse tempo, ela será considerada malsucedida e poderá ser repetida de acordo com ai_function_max_retries.

ai_function_retry_initial_delay_ms

Atraso inicial, em milissegundos, antes da primeira nova tentativa de uma solicitação de API com falha da função de IA. O atraso dobra a cada tentativa subsequente (backoff exponencial). Por exemplo, com as configurações padrão: 1000ms, 2000ms, 4000ms.

ai_function_text_default_credentials

Nome da coleção nomeada usada pelas funções de IA de texto (aiGenerate, aiClassify, aiFilter, aiExtract, aiTranslate, aiRedact) quando a chamada não fornece credentials no mapa de parâmetros. Vazio significa que não há padrão: essas chamadas devem fornecer credentials explicitamente. Um endpoint de chat completions é diferente de um de embeddings, portanto isso é separado de ai_function_embedding_default_credentials.

ai_function_throw_on_error

Se true (padrão), uma chamada de função de IA que falhar permanentemente após esgotar todas as tentativas interrompe a consulta com uma exceção. Se false, a linha com falha recebe o valor padrão para o tipo da coluna (string vazia para String), e o processamento continua.

ai_function_throw_on_quota_exceeded

Se true (padrão), exceder um limite de cota de uma função de IA (ai_function_max_input_tokens_per_query, ai_function_max_output_tokens_per_query ou ai_function_max_api_calls_per_query) interrompe a consulta com uma exceção. Se false, as linhas restantes recebem o valor padrão do tipo de coluna (string vazia para String). Assim como os limites de cota, isso deve ser definido na consulta de nível superior — uma substituição de SETTINGS em uma subconsulta é ignorada.
Última modificação em 26 de agosto de 2026