- 引入 MemoryRouterXL 与 v5/v6 流式多线程训练/编码管线 - 修复 prepare_memory_router_dataset 候选池重建缺陷(mega 家族 3568x 加速,输出逐字节相同) - 修复 v5 被破坏的拒答与多跳标签(train 未知样本 319 -> 16319,multi_hop 平均正例 1.00 -> 2.00) - 同存储预算下 V2-128 v6 逐轴 22/22 通过:Top-1 41.12% -> 94.62%,未知拒答 0.00% -> 100.00% - 记录三条被实测推翻的显然优化(logits_to_keep=1 反而慢 55%、XL 容量未带来收益) - 记忆手术跨架构可移植性 14/14,读写关闭时与原生模型逐位相同
28 lines
586 B
JSON
28 lines
586 B
JSON
{
|
|
"eval_file": "V2_dpskw\\data\\zero_overlap\\eval.jsonl",
|
|
"episodes": 250,
|
|
"answerable_episodes": 250,
|
|
"chance_top1_pct": 4.17,
|
|
"rankers": {
|
|
"REPLAY-128": {
|
|
"top1_pct": 59.6,
|
|
"recall3_pct": 83.2,
|
|
"mrr_pct": 73.06
|
|
},
|
|
"V2-128-v6": {
|
|
"top1_pct": 18.4,
|
|
"recall3_pct": 36.0,
|
|
"mrr_pct": 35.07
|
|
},
|
|
"cosine": {
|
|
"top1_pct": 30.4,
|
|
"recall3_pct": 49.2,
|
|
"mrr_pct": 44.84
|
|
},
|
|
"text_retriever": {
|
|
"top1_pct": 23.2,
|
|
"recall3_pct": 55.2,
|
|
"mrr_pct": 43.16
|
|
}
|
|
}
|
|
} |