.env.example 7.4 KB

123456789101112131415161718192021222324252627282930313233343536373839404142434445464748495051525354555657585960616263646566676869707172737475767778798081828384858687888990919293949596979899100101102103104105106107108109110111112113114115116117118119120121122123124125126127128129130131132133134135136137138139140141142143144145146147148149150151152153154155
  1. # Servidor (valores abaixo já são o padrão do código — só setar para sobrescrever)
  2. # PORT=3001
  3. # CORS_ORIGIN=http://localhost:5173
  4. # Autenticação. AUTH_MODE=jwt precisa ficar explícito: o padrão do código é "none"
  5. # (sem autenticação nenhuma) — não deixar essa linha comentada em produção.
  6. AUTH_MODE=jwt
  7. JWT_SECRET=coloque-um-segredo-longo-e-aleatorio-aqui
  8. # JWT_ISSUER=oraculo-api
  9. # JWT_ACCESS_TTL_SECONDS=900
  10. # JWT_REFRESH_TTL_SECONDS=2592000
  11. # TTL do refresh token quando rememberMe=false/ausente no login (default 1 dia, já é o padrão do código).
  12. # JWT_REFRESH_TTL_SHORT_SECONDS=86400
  13. # API Key alternativa (opcional, deixar vazio/comentado para usar só JWT)
  14. # API_KEY=
  15. # Banco de dados MySQL
  16. DB_HOST=localhost
  17. DB_PORT=3306
  18. DB_USER=usuario
  19. DB_PASS=senha
  20. DB_SCHEMA=oraculo
  21. # SSL para conexão MySQL (recomendado em produção). Deixe ambos vazios para desativar
  22. # SSL (comportamento padrão em dev local). DB_SSL_REJECT_UNAUTHORIZED=true valida o
  23. # certificado do servidor; DB_SSL_CA aponta para um arquivo de certificado CA (ex.:
  24. # ./certs/rds-ca.pem) se o servidor usar um certificado não confiável publicamente.
  25. DB_SSL_REJECT_UNAUTHORIZED=true
  26. DB_SSL_CA=
  27. # Qdrant (vector DB) — valores abaixo já são o padrão do código
  28. # QDRANT_URL=http://localhost:6333
  29. # QDRANT_COLLECTION=oraculo_docs
  30. QDRANT_API_KEY=
  31. # Ollama — valores abaixo já são o padrão do código
  32. # OLLAMA_URL=http://localhost:11434
  33. # OLLAMA_EMBEDDINGS_MODEL=nomic-embed-text
  34. # OLLAMA_CHAT_MODEL=llama3.1
  35. # OLLAMA_VISION_MODEL=llava:latest
  36. # Modelo usado na sugestão de resposta ao atendente (ConversasWhatsapp). Default
  37. # já é "star-atendente" no código mesmo sem essa variável — só setar se publicar
  38. # o modelo fine-tuned com outro nome no Ollama.
  39. # OLLAMA_ATENDENTE_MODEL=star-atendente
  40. # Timeout (ms) para chamadas não-streaming ao Ollama (chat/embeddings) — já é o padrão do
  41. # código. Sem esse limite, uma chamada travada (modelo sobrecarregado, processo do Ollama
  42. # pendurado) nunca resolve nem rejeita — trava indefinidamente locks como o de avaliação
  43. # em lote de atendimentos. Só sobrescrever se precisar de um valor diferente.
  44. # OLLAMA_TIMEOUT_MS=180000
  45. # Timeout de inatividade (ms) para o streaming do chat (chatCompletionStream) — já é o
  46. # padrão do código. Diferente do OLLAMA_TIMEOUT_MS (que limita o total de uma chamada
  47. # não-streaming), este reinicia a cada chunk recebido — só dispara se o Ollama parar de
  48. # mandar bytes no meio de uma resposta, o que antes deixava a UI presa em "Gerando
  49. # resposta..." para sempre.
  50. # OLLAMA_STREAM_IDLE_TIMEOUT_MS=60000
  51. # Prefixos opcionais prependados ao texto antes de gerar embedding (útil para modelos
  52. # assimétricos que recomendam prefixo diferente para query de busca e passagem indexada,
  53. # ex.: "search_query: "/"search_document: " no nomic-embed-text, "query: "/"passage: " em
  54. # modelos da família e5). Vazio (padrão) = modelo não recebe prefixo. Validar empiricamente
  55. # com backend/scripts/evalRetrieval.mjs antes de habilitar em produção.
  56. # OLLAMA_EMBED_QUERY_PREFIX=
  57. # OLLAMA_EMBED_PASSAGE_PREFIX=
  58. # RAG — valores abaixo já são o padrão do código
  59. # RAG_TOP_K=8
  60. # RAG_CHUNK_SIZE=900
  61. # RAG_CHUNK_OVERLAP=150
  62. # Quantidade de mensagens recentes do histórico incluídas no prompt de rewrite/chat (já é o padrão do código).
  63. # RAG_HISTORY_LIMIT=6
  64. # Rate limiting por IP (0 = desativado). Recomendado manter >0 em produção — sem isso
  65. # o middleware de rate limit vira um no-op e o /api fica sem proteção contra abuso.
  66. RATE_LIMIT_PER_MINUTE=60
  67. # Ajuste fino das respostas do LLM — valores abaixo já são o padrão do código, exceto
  68. # LLM_NUM_PREDICT (padrão real: 4096; aqui reduzido para respostas mais curtas/rápidas).
  69. # LLM_TEMPERATURE=0.2
  70. # LLM_TOP_P=0.9
  71. LLM_NUM_PREDICT=2048
  72. # LLM_REPEAT_PENALTY=1.1
  73. # RAG avançado — valores abaixo já são o padrão do código (tudo desligado)
  74. # RAG_QUERY_REWRITE=false
  75. # RAG_MIN_SCORE=0.40
  76. # RAG_RERANK=false
  77. # RAG_RERANK_TOP_N=8
  78. # HyDE (Hypothetical Document Embeddings): gera um trecho hipotético de resposta via LLM
  79. # e usa ele (em vez da query crua) para o embedding de busca, o que tende a elevar o score
  80. # de similaridade porque vira matching passagem-passagem. Custa uma chamada LLM extra por
  81. # pergunta. Desligado por padrão no código. Validar com backend/scripts/evalRetrieval.mjs
  82. # antes de habilitar em produção.
  83. # RAG_HYDE=false
  84. # Chatbot ifbot (sincronização de atendimentos) — URL e intervalo abaixo já são o padrão do código
  85. # IFBOT_BASE_URL=https://star.ifbot.com.br/api
  86. IFBOT_TOKEN=
  87. # IFBOT_AUTH_HEADER=Authorization
  88. # base pública dos arquivos de mídia (/data/img, /data/aud); padrão: IFBOT_BASE_URL sem o sufixo /api
  89. # IFBOT_MEDIA_BASE_URL=https://star.ifbot.com.br
  90. # ATENDIMENTOS_SYNC_INTERVAL_MINUTES=30
  91. # RAG de atendimentos (ingestão de conversas no Qdrant, coleção separada da de documentos)
  92. # ATENDIMENTOS_RAG_COLLECTION=atendimentos_rag
  93. # ATENDIMENTOS_RAG_INTERVAL_MINUTES=60
  94. # ATENDIMENTOS_RAG_BATCH=10
  95. # ATENDIMENTOS_RAG_CHUNK_SIZE=1800
  96. # ATENDIMENTOS_RAG_CHUNK_OVERLAP=200
  97. # ATENDIMENTOS_RAG_TOP_K=20
  98. # ATENDIMENTOS_RAG_MIN_SCORE=0.5
  99. # habilita a busca vetorial no modo "atendimentos" do chat — deixar false até calibrar
  100. # ATENDIMENTOS_RAG_MIN_SCORE com perguntas reais após o backfill inicial
  101. # ATENDIMENTOS_RAG_SEARCH_ENABLED=false
  102. # WhatsApp Cloud API (Meta) — usada pelo chat de Atendimentos (/api/conversas) e pelo
  103. # webhook em /webhooks/whatsapp (fora de /api, sem JWT — protegido por hub.verify_token
  104. # na verificação e, opcionalmente, assinatura HMAC no recebimento).
  105. #
  106. # Valores vêm do painel da Meta (developers.facebook.com/apps/<seu-app>/whatsapp-business/wa-dev-console/):
  107. # - WHATSAPP_PHONE_NUMBER_ID e WHATSAPP_TOKEN: aba "API Setup" (o token temporário expira
  108. # em 24h; gere um token permanente em System Users antes de ir pra produção)
  109. # - WHATSAPP_VERIFY_TOKEN: valor arbitrário definido por você — cole o mesmo valor no
  110. # painel da Meta em WhatsApp → Configuration → Webhook → "Verify token"
  111. # - WHATSAPP_APP_SECRET: aba "App settings → Basic", campo "App Secret" — valida a
  112. # assinatura X-Hub-Signature-256 dos eventos recebidos; vazio desativa a validação
  113. # - WHATSAPP_BUSINESS_ACCOUNT_ID (opcional, não usado ainda): mesma tela do API Setup,
  114. # reservado para gestão de templates/perfil de negócio no futuro
  115. # WHATSAPP_API_VERSION já é o padrão do código
  116. # WHATSAPP_API_VERSION=v21.0
  117. WHATSAPP_PHONE_NUMBER_ID=
  118. WHATSAPP_TOKEN=
  119. WHATSAPP_VERIFY_TOKEN=
  120. WHATSAPP_APP_SECRET=
  121. # WHATSAPP_BUSINESS_ACCOUNT_ID=
  122. # Integrador IXC (Alfred) — usadas só pelo seed (npm run seed:run), que provisiona a
  123. # linha na tabela "integracao". Em runtime o service lê Url/Login/Senha/Token do banco,
  124. # não daqui (token sobrevive a restart; ver src/functions/atualizaTokenIxcIntegradorERetorna.js).
  125. # Rodar o seed de novo com Login/Senha diferentes força um novo login (invalida o token cacheado).
  126. IXC_INTEGRADOR_BASE_URL=http://localhost:4001/
  127. IXC_INTEGRADOR_LOGIN=
  128. IXC_INTEGRADOR_SENHA=
  129. # Transcrição de áudio via Whisper local (whisper.cpp), usada como fallback quando o
  130. # ifbot não traz Transcricao — requer `brew install whisper-cpp ffmpeg` e o modelo
  131. # baixado em WHISPER_MODEL_PATH. Desligado por padrão no código (false); setar aqui
  132. # como lembrete de que a feature existe e precisa desses binários/modelo instalados.
  133. WHISPER_TRANSCRICAO_ENABLED=false
  134. # WHISPER_BINARY_PATH=whisper-cli
  135. # WHISPER_FFMPEG_PATH=ffmpeg
  136. # WHISPER_MODEL_PATH=whisper_models/ggml-small.bin
  137. # WHISPER_TIMEOUT_MS=60000