feat(rag): v1 rerank 精排 + bge-m3 多语言切换(T6/T11 架构审查整改)
- T6 (Issue6): RerankConfig(enabled/model=BAAI/bge-reranker-v2-m3/device)
- rag-layer-design §6.3 Rerank 精排:窗口=RRF top-10、候选≤top_k 跳过、
故障降级 RRF 原序;原 §6.3-6.6 顺延 6.4-6.7
- config-design §5 新增 rerank 段;design §5.5 检索策略加 rerank
- T11 (OV2): EmbeddingConfig.model 默认 bge-small-zh-v1.5 → BAAI/bge-m3(日文语料)
- rag-layer-design 选型表/依赖表/manifest/流程图同步 + 新增 §2.3 日文样本验证
- design.md / implementation-plan 4.3 / config-design embedding 同步
- 新增 test_rag_design_consistency.py 一致性门禁(6 用例防文档漂移)
- TDD: RED(默认模型仍旧 + rerank 字段不存在)→ GREEN → 全量 198 passed / 100.00%(996 stmts/252 br)
This commit is contained in:
+10
-5
@@ -156,10 +156,10 @@ prompt_registry:
|
||||
```yaml
|
||||
# config/rag.yaml
|
||||
embedding:
|
||||
model: BAAI/bge-small-zh-v1.5 # 可切 BAAI/bge-m3
|
||||
device: cpu # cpu | cuda
|
||||
max_batch_size: 32 # 编码批大小
|
||||
cache_dir: /data/shared/models # 模型缓存目录
|
||||
model: BAAI/bge-m3 # 多语言(中/日/英),适配日文语料(OV2/T11)
|
||||
device: cpu # cpu | cuda
|
||||
max_batch_size: 32 # 编码批大小
|
||||
cache_dir: /data/shared/models # 模型缓存目录
|
||||
|
||||
vector_store: # StorageAdapter 配置(rag-layer §9.4)
|
||||
adapter: chroma # v1 仅 chroma(qdrant 为 v2 预留)
|
||||
@@ -176,7 +176,12 @@ retrieval:
|
||||
channel_top_k: 10 # 双通道各取 top-10
|
||||
rrf_k: 60 # RRF 融合常数(rag-layer §6.2)
|
||||
default_top_k: 5 # 融合后默认返回数
|
||||
contextual_enrichment: true # 上下文增强开关(§6.3)
|
||||
contextual_enrichment: true # 上下文增强开关(§6.4)
|
||||
|
||||
rerank: # Rerank 精排(rag-layer §6.3,v1 新增 I6/T6)
|
||||
enabled: true # false 时跳过精排,直接取 RRF 前 top_k
|
||||
model: BAAI/bge-reranker-v2-m3 # 多语言 Cross-Encoder
|
||||
device: cpu # cpu | cuda
|
||||
```
|
||||
|
||||
---
|
||||
|
||||
Reference in New Issue
Block a user