feat(rag): v1 rerank 精排 + bge-m3 多语言切换(T6/T11 架构审查整改)

- T6 (Issue6): RerankConfig(enabled/model=BAAI/bge-reranker-v2-m3/device)
  - rag-layer-design §6.3 Rerank 精排:窗口=RRF top-10、候选≤top_k 跳过、
    故障降级 RRF 原序;原 §6.3-6.6 顺延 6.4-6.7
  - config-design §5 新增 rerank 段;design §5.5 检索策略加 rerank
- T11 (OV2): EmbeddingConfig.model 默认 bge-small-zh-v1.5 → BAAI/bge-m3(日文语料)
  - rag-layer-design 选型表/依赖表/manifest/流程图同步 + 新增 §2.3 日文样本验证
  - design.md / implementation-plan 4.3 / config-design embedding 同步
- 新增 test_rag_design_consistency.py 一致性门禁(6 用例防文档漂移)
- TDD: RED(默认模型仍旧 + rerank 字段不存在)→ GREEN → 全量 198 passed / 100.00%(996 stmts/252 br)
This commit is contained in:
lhl
2026-08-12 11:32:28 +08:00
parent c170ec2edd
commit 3decdfc31c
9 changed files with 186 additions and 24 deletions
+10 -5
View File
@@ -156,10 +156,10 @@ prompt_registry:
```yaml
# config/rag.yaml
embedding:
model: BAAI/bge-small-zh-v1.5 # 可切 BAAI/bge-m3
device: cpu # cpu | cuda
max_batch_size: 32 # 编码批大小
cache_dir: /data/shared/models # 模型缓存目录
model: BAAI/bge-m3 # 多语言(中/日/英),适配日文语料(OV2/T11)
device: cpu # cpu | cuda
max_batch_size: 32 # 编码批大小
cache_dir: /data/shared/models # 模型缓存目录
vector_store: # StorageAdapter 配置(rag-layer §9.4
adapter: chroma # v1 仅 chromaqdrant 为 v2 预留)
@@ -176,7 +176,12 @@ retrieval:
channel_top_k: 10 # 双通道各取 top-10
rrf_k: 60 # RRF 融合常数(rag-layer §6.2
default_top_k: 5 # 融合后默认返回数
contextual_enrichment: true # 上下文增强开关(§6.3
contextual_enrichment: true # 上下文增强开关(§6.4
rerank: # Rerank 精排(rag-layer §6.3v1 新增 I6/T6
enabled: true # false 时跳过精排,直接取 RRF 前 top_k
model: BAAI/bge-reranker-v2-m3 # 多语言 Cross-Encoder
device: cpu # cpu | cuda
```
---