Files
ai-gateway-go/.env.example
T
superidou b536672000 feat(m8): P2 pgvector + Ollama 向量化与语义检索
- PostgreSQL 切换 pgvector/pgvector:pg17 镜像;迁移 000024 建 vector 扩展、
  knowledge_chunks.embedding vector(1024) + HNSW 余弦索引,retrieval_mode 放宽三态
- OllamaEmbedder 本地 bge-m3 批量嵌入,404 惰性 pull 重试,维度/超时校验,可整体关闭
- SemanticRetriever/HybridRetriever + NewRetriever 按 retrieval_mode 分发,缺 embedder 回退 FTS
- 文档入库同步批量向量化;Ollama 故障降级入库 + embedding_failed 事件
- 修复 pgx CopyFrom 对 vector 列二进制编码误读:COPY 基础列后同事务 unnest 批量回填
- 修复降级路径 embeddings=nil 索引越界 panic(Add 与 Reprocess)
- 知识库列表 vectorized_chunk_count + 前端三态检索模式选择与向量化覆盖率
- 单测 embedder/retrievers + 集成 TestKnowledgeVectorLifecycle 全绿

Co-Authored-By: Claude <noreply@anthropic.com>
2026-08-12 15:16:32 +08:00

95 lines
3.0 KiB
Bash

APP_ENV=local
HTTP_ADDR=:8080
HTTP_READ_HEADER_TIMEOUT=5s
HTTP_IDLE_TIMEOUT=120s
HTTP_SHUTDOWN_TIMEOUT=20s
HTTP_MAX_BODY_BYTES=33554432
DATABASE_URL=postgres://gateway:gateway@localhost:5432/gateway?sslmode=disable
DATABASE_MAX_CONNS=40
DATABASE_MIN_CONNS=4
REDIS_CRITICAL_URL=redis://localhost:6379/0
REDIS_CACHE_URL=redis://localhost:6380/0
AUTH_SESSION_TTL=12h
AUTH_TOTP_CHALLENGE_TTL=5m
LOGIN_MAX_FAILURES=5
LOGIN_LOCK_DURATION=15m
# 登录防爆破:按 IP 的滑动窗口限流(与上面的账号锁定叠加)。
# 单 IP 在窗口内最多 LOGIN_RATE_LIMIT_MAX 次登录尝试,超出返回 429。
LOGIN_RATE_LIMIT_MAX=30
LOGIN_RATE_LIMIT_WINDOW=5m
# Base64-encoded 32-byte AES-256 key. Generate with: openssl rand -base64 32
CREDENTIAL_MASTER_KEY=
CREDENTIAL_KEK_VERSION=1
ALLOW_PRIVATE_PROVIDER_URLS=false
ALLOW_PRIVATE_TOOL_URLS=false
ALLOW_PRIVATE_WEBHOOK_URLS=false
PROVIDER_REFRESH_INTERVAL=5s
# Transitional bootstrap credential. It will be replaced by database-backed API keys.
# Disabled by default for security; it bypasses per-key rate limits and tenant
# isolation, so only enable it during migration with a strong random value.
GATEWAY_BOOTSTRAP_API_KEY_ENABLED=false
GATEWAY_BOOTSTRAP_API_KEY=
UPSTREAM_BASE_URL=https://api.openai.com
UPSTREAM_API_KEY=
UPSTREAM_FALLBACK_ENABLED=true
AUDIT_QUEUE_SIZE=4096
AUDIT_BATCH_SIZE=200
AUDIT_FLUSH_INTERVAL=1s
AUDIT_RETENTION=2160h
USAGE_RETENTION=17520h
AUDIT_PARTITION_MONTHS_AHEAD=3
AUDIT_MAINTENANCE_INTERVAL=6h
# Keep the {outbox} hash tag so marker and Stream keys share a Redis Cluster slot.
OUTBOX_STREAM=gateway:{outbox}:events
OUTBOX_BATCH_SIZE=100
OUTBOX_POLL_INTERVAL=500ms
OUTBOX_LEASE=30s
OUTBOX_MAX_ATTEMPTS=10
OUTBOX_MAX_BACKOFF=5m
OUTBOX_STREAM_MAX_LENGTH=100000
OUTBOX_MARKER_TTL=720h
# Multi-instance immutable snapshot refresh. Admin writes also reload the local process immediately.
CONTENT_POLICY_REFRESH_INTERVAL=30s
PRICING_REFRESH_INTERVAL=30s
# Opt-in non-streaming JSON shadow traffic. A dedicated credential is mandatory;
# production client Authorization headers are never forwarded to the shadow.
SHADOW_BASE_URL=
SHADOW_API_KEY=
SHADOW_SAMPLE_RATE=0
SHADOW_TIMEOUT=20s
SHADOW_MAX_BODY_BYTES=2097152
SHADOW_MAX_CONCURRENT=16
# M8 对象存储(MinIO)。上传/下载全部经网关代理,MinIO 不暴露主机端口。
# 本地 compose 会自带一个 minio 服务;连远端 S3 时把 S3_ENDPOINT 指向它即可。
S3_ENDPOINT=http://minio:9000
S3_ACCESS_KEY_ID=gateway
S3_SECRET_ACCESS_KEY=gateway-secret
S3_BUCKET=gateway-files
S3_REGION=us-east-1
S3_USE_SSL=false
S3_MAX_FILE_BYTES=134217728
# M8 P2 向量化(本地 Ollama,默认 bge-m3)。设为 false 可整体关闭,知识库退回纯 FTS。
# EMBEDDING_DIM 必须与迁移 000024 的 vector(1024) 列一致。
EMBEDDINGS_ENABLED=true
OLLAMA_BASE_URL=http://ollama:11434
EMBEDDING_MODEL=bge-m3
EMBEDDING_DIM=1024
EMBEDDING_BATCH_SIZE=64
EMBEDDING_TIMEOUT=120s
# Used only by cmd/gateway-bootstrap; never commit the real value.
BOOTSTRAP_ADMIN_USERNAME=admin
BOOTSTRAP_ADMIN_PASSWORD=