- 引入 MemoryRouterXL 与 v5/v6 流式多线程训练/编码管线 - 修复 prepare_memory_router_dataset 候选池重建缺陷(mega 家族 3568x 加速,输出逐字节相同) - 修复 v5 被破坏的拒答与多跳标签(train 未知样本 319 -> 16319,multi_hop 平均正例 1.00 -> 2.00) - 同存储预算下 V2-128 v6 逐轴 22/22 通过:Top-1 41.12% -> 94.62%,未知拒答 0.00% -> 100.00% - 记录三条被实测推翻的显然优化(logits_to_keep=1 反而慢 55%、XL 容量未带来收益) - 记忆手术跨架构可移植性 14/14,读写关闭时与原生模型逐位相同
10 lines
510 B
Markdown
10 lines
510 B
Markdown
# 运行时端到端评测(零重叠改写,大样本)
|
|
|
|
每条 episode 把全部 32 个同形候选事实写入运行时,再问改写后的问题。
|
|
随机基线 1/32 = 3.12%。全部为百分比。
|
|
|
|
| blend | 用例 | 可回答 | 回答正确率 | 答成别的属性 | 未知泄漏率 | 平均选中记录 | 活跃记录 min/max |
|
|
|---|---:|---:|---:|---:|---:|---:|---|
|
|
| 0.00 | 40 | 33 | 69.70% | 3.03% | 0.00% | 5.2750 | 17/32 |
|
|
| 0.50 | 40 | 33 | 69.70% | 3.03% | 0.00% | 5.2750 | 17/32 |
|