# Servidor PORT=3001 CORS_ORIGIN=http://localhost:5173 # Autenticação (jwt ou none) AUTH_MODE=jwt JWT_SECRET=coloque-um-segredo-longo-e-aleatorio-aqui JWT_ISSUER=oraculo-api JWT_ACCESS_TTL_SECONDS=900 JWT_REFRESH_TTL_SECONDS=2592000 # API Key alternativa (opcional, deixar vazio para usar só JWT) API_KEY= # Banco de dados MySQL DB_HOST=localhost DB_PORT=3306 DB_USER=usuario DB_PASS=senha DB_SCHEMA=oraculo # Qdrant (vector DB) QDRANT_URL=http://localhost:6333 QDRANT_COLLECTION=oraculo_docs QDRANT_API_KEY= # Ollama OLLAMA_URL=http://localhost:11434 OLLAMA_EMBEDDINGS_MODEL=nomic-embed-text OLLAMA_CHAT_MODEL=llama3 OLLAMA_VISION_MODEL=llava # Prefixos opcionais prependados ao texto antes de gerar embedding (útil para modelos # assimétricos que recomendam prefixo diferente para query de busca e passagem indexada, # ex.: "search_query: "/"search_document: " no nomic-embed-text, "query: "/"passage: " em # modelos da família e5). Deixe vazio se o modelo não precisar. Validar empiricamente com # backend/scripts/evalRetrieval.mjs antes de habilitar em produção. OLLAMA_EMBED_QUERY_PREFIX= OLLAMA_EMBED_PASSAGE_PREFIX= # RAG (valores padrão se não definidos) RAG_TOP_K=8 RAG_CHUNK_SIZE=900 RAG_CHUNK_OVERLAP=150 # Rate limiting (0 = desativado) RATE_LIMIT_PER_MINUTE=0 # Ajuste fino das respostas do LLM LLM_TEMPERATURE=0.2 LLM_TOP_P=0.9 LLM_NUM_PREDICT=2048 LLM_REPEAT_PENALTY=1.1 # RAG avançado RAG_QUERY_REWRITE=false RAG_MIN_SCORE=0.40 RAG_RERANK=false RAG_RERANK_TOP_N=8 # HyDE (Hypothetical Document Embeddings): gera um trecho hipotético de resposta via LLM # e usa ele (em vez da query crua) para o embedding de busca, o que tende a elevar o score # de similaridade porque vira matching passagem-passagem. Custa uma chamada LLM extra por # pergunta. Validar com backend/scripts/evalRetrieval.mjs antes de habilitar em produção. RAG_HYDE=false