ai_function_allow_insecure_endpoint
endpoint de coleção nomeada que enviaria prompts e chaves de API por uma conexão não criptografada a um host remoto: qualquer endpoint não HTTPS cujo host não seja de loopback é rejeitado com uma exceção. Endpoints de loopback (por exemplo, um servidor de modelo local em http://localhost) são sempre permitidos. Defina como true para permitir endpoints http:// em texto simples em hosts remotos.
ai_function_embedding_default_credentials
aiEmbed, aiSimilarity) quando a chamada não fornece credentials no mapa de parâmetros. Vazio significa que não há valor padrão: essas chamadas devem fornecer credentials explicitamente. Essas funções usam model como argumento posicional obrigatório, e não a partir da coleção nomeada. Isso é mantido separado de ai_function_text_default_credentials porque um endpoint de embeddings é diferente de um endpoint de chat.
ai_function_embedding_max_batch_size
aiEmbed, aiSimilarity). Os textos são agrupados em lotes desse tamanho para reduzir a sobrecarga das chamadas de API. Por exemplo, 500 textos únicos com lote de 100 resultam em 5 requisições HTTP.
ai_function_max_api_calls_per_query
SETTINGS em uma subconsulta é ignorada. Defina como 0 para desabilitar.
ai_function_max_input_tokens_per_query
prompt) em todas as chamadas de API da função de IA em uma única consulta. O total é contabilizado de forma cumulativa com base nas respostas dos provedores. Observe que esse limite pode ser excedido pelo volume de tokens de entrada de até uma chamada por solicitação em andamento, já que os tokens de entrada de uma chamada não são conhecidos até que sua resposta chegue. Assim como as outras cotas de IA, ele é aplicado por servidor / fragmento de consulta, não sendo somado em uma consulta distribuída, e deve ser definido na consulta de nível superior — uma substituição de SETTINGS em uma subconsulta é ignorada. Defina como 0 para desativar.
Esse limite só é aplicado a provedores que informam um objeto usage na resposta (OpenAI, Anthropic, vLLM). Provedores que omitem o uso de tokens (principalmente o HuggingFace TEI) fazem com que o contador permaneça em 0 — use ai_function_max_api_calls_per_query para limitar essas chamadas.
ai_function_max_output_tokens_per_query
SETTINGS em uma subconsulta é ignorada. Defina como 0 para desativar.
Esse limite só é aplicado a provedores que informam um objeto usage na resposta (OpenAI, Anthropic, vLLM). Ele não se aplica às funções de embedding (aiEmbed, aiSimilarity), que nunca produzem tokens de saída.
ai_function_max_retries
ai_function_retry_initial_delay_ms.
ai_function_request_timeout_sec
ai_function_max_retries.
ai_function_retry_initial_delay_ms
ai_function_text_default_credentials
aiGenerate, aiClassify, aiFilter, aiExtract, aiTranslate, aiRedact) quando a chamada não fornece credentials no mapa de parâmetros. Vazio significa que não há padrão: essas chamadas devem fornecer credentials explicitamente. Um endpoint de chat completions é diferente de um de embeddings, portanto isso é separado de ai_function_embedding_default_credentials.
ai_function_throw_on_error
ai_function_throw_on_quota_exceeded
ai_function_max_input_tokens_per_query, ai_function_max_output_tokens_per_query ou ai_function_max_api_calls_per_query) interrompe a consulta com uma exceção. Se false, as linhas restantes recebem o valor padrão do tipo de coluna (string vazia para String). Assim como os limites de cota, isso deve ser definido na consulta de nível superior — uma substituição de SETTINGS em uma subconsulta é ignorada.