Files
assafelovic--gpt-researcher/.env.example
T
2026-07-13 12:39:12 +08:00

67 lines
2.4 KiB
Bash

OPENAI_API_KEY=
TAVILY_API_KEY=
BRAVE_API_KEY=
XQUIK_API_KEY=
DOC_PATH=./my-docs
# NEXT_PUBLIC_GPTR_API_URL=http://0.0.0.0:8000 # Defaults to localhost:8000 if not set
# Scraper Configuration
# ---------------------
# Control concurrent scraping and rate limiting to respect API limits
# Maximum concurrent scraper workers (simultaneous operations)
# Adjust based on your scraper service limits:
# - Firecrawl Free: 2 concurrent browsers
# - Firecrawl Hobby: 5 concurrent browsers
# - BeautifulSoup/other scrapers: Set based on target site limits
# Default: 15 (may be too high for rate-limited APIs)
#MAX_SCRAPER_WORKERS=15
# Rate limiting: minimum seconds between scraper requests
# Controls request frequency to avoid exceeding API rate limits
# Calculate as: 60 / requests_per_minute
# Examples:
# - Firecrawl Free (10 req/min): 6.0 seconds
# - Firecrawl /scrape (10 req/min): 6.0 seconds
# - Custom API (30 req/min): 2.0 seconds
# - No rate limit: 0 (default)
# Note: Works with all scrapers (firecrawl, bs, browser, etc.)
# Default: 0.0 (no rate limiting)
#SCRAPER_RATE_LIMIT_DELAY=0.0
# Performance Optimization
# ------------------------
# Smart context compression: Skip expensive embedding-based filtering for small documents
# When scraped content is already concise, directly use it instead of running compression pipeline
# This can reduce latency by 40-50% for queries with small result sets
# Default: 8000 characters (8KB threshold)
#COMPRESSION_THRESHOLD=8000
# LangChain Tracing (LangSmith) - Enable for enhanced observability
# To enable tracing, uncomment the following lines and provide your API Key
# LANGCHAIN_TRACING_V2=true
# LANGCHAIN_ENDPOINT="https://api.smith.langchain.com"
# LANGCHAIN_API_KEY=
# LANGCHAIN_PROJECT="gpt-researcher"
# Token Limits
# ------------
# Maximum output tokens per LLM call. Leaving unset uses package defaults
# (FAST=3000, SMART=6000, STRATEGIC=4000) suited to GPT-4o-class models.
# Modern long-output models (Claude 4.x, GPT-5) truncate reports at
# these defaults.
#
# Recommended values by model class:
# GPT-4o family (16k max output): SMART_TOKEN_LIMIT=8000
# Claude Haiku 4.5 (64k max): SMART_TOKEN_LIMIT=16000
# Claude Sonnet 4.6 (64k max): SMART_TOKEN_LIMIT=16000
# Claude Opus 4.7 (128k max): SMART_TOKEN_LIMIT=32000
# GPT-5 family (128k max): SMART_TOKEN_LIMIT=32000
#
# FAST_TOKEN_LIMIT=8000
# SMART_TOKEN_LIMIT=16000
# STRATEGIC_TOKEN_LIMIT=16000
GROUNDROUTE_API_KEY=