31. IterBatch/MergeBatch GM 读取量超输入总量: K切分按整段上取+驻留侧重复计, 应每字节恰读一次=V_in #31
Reference in New Issue
Block a user
No description provided.
Delete Branch "%!s()"
Deleting a branch is permanent. Although the deleted branch may continue to exist for a short time before it actually gets removed, it CANNOT be undone in most cases. Continue?
现象 (result_recommend.csv)
b64_m16_n256_k512 (IterBatch, 形态 c, K=512 切 3 段 k_L1=240): gm_read_bytes=25.1MB > 输入 A+B 总量 17.8MB。
根因
IterBatch 的 K 切分各 (batch, K段) 数据互不重叠, 每个输入字节恰好从 GM 读一次 (重复读只存在于 L1 驻留形态内部, 不产生 GM/L2 流量); 当前模型把每段按整段 k_L1 计 (末段剩余 512-2x240=32 也按 240 计), 且形态 c 把"驻留侧 A"按每个 K 段重复计, 造成 GM 上浮 ~40%。MergeBatch 的 L1 绑定分支同类 (n_K*k_L1 上取)。
这与 "GM 至少读一次、每字节恰好一次即最优" 的物理口径不符 (docs/05 R1 之前把"末段整段上取"当作建模约定, 现撤销)。
修复 (按 R1 精确计)
修复 commit:
18f5959落地 (issue 正文方案):
物理口径: IterBatch/MergeBatch 无 L2 级重复读结构 (K 段/驻留侧互不重叠), GM 与 L2 容量无关 —— 每字节恰好从 GM 读一次即最优。