feat(m8): P2 pgvector + Ollama 向量化与语义检索
- PostgreSQL 切换 pgvector/pgvector:pg17 镜像;迁移 000024 建 vector 扩展、 knowledge_chunks.embedding vector(1024) + HNSW 余弦索引,retrieval_mode 放宽三态 - OllamaEmbedder 本地 bge-m3 批量嵌入,404 惰性 pull 重试,维度/超时校验,可整体关闭 - SemanticRetriever/HybridRetriever + NewRetriever 按 retrieval_mode 分发,缺 embedder 回退 FTS - 文档入库同步批量向量化;Ollama 故障降级入库 + embedding_failed 事件 - 修复 pgx CopyFrom 对 vector 列二进制编码误读:COPY 基础列后同事务 unnest 批量回填 - 修复降级路径 embeddings=nil 索引越界 panic(Add 与 Reprocess) - 知识库列表 vectorized_chunk_count + 前端三态检索模式选择与向量化覆盖率 - 单测 embedder/retrievers + 集成 TestKnowledgeVectorLifecycle 全绿 Co-Authored-By: Claude <noreply@anthropic.com>
This commit is contained in:
@@ -80,6 +80,15 @@ S3_REGION=us-east-1
|
||||
S3_USE_SSL=false
|
||||
S3_MAX_FILE_BYTES=134217728
|
||||
|
||||
# M8 P2 向量化(本地 Ollama,默认 bge-m3)。设为 false 可整体关闭,知识库退回纯 FTS。
|
||||
# EMBEDDING_DIM 必须与迁移 000024 的 vector(1024) 列一致。
|
||||
EMBEDDINGS_ENABLED=true
|
||||
OLLAMA_BASE_URL=http://ollama:11434
|
||||
EMBEDDING_MODEL=bge-m3
|
||||
EMBEDDING_DIM=1024
|
||||
EMBEDDING_BATCH_SIZE=64
|
||||
EMBEDDING_TIMEOUT=120s
|
||||
|
||||
# Used only by cmd/gateway-bootstrap; never commit the real value.
|
||||
BOOTSTRAP_ADMIN_USERNAME=admin
|
||||
BOOTSTRAP_ADMIN_PASSWORD=
|
||||
|
||||
Reference in New Issue
Block a user