Fix issues #23-#25 (+#26 标注): GM读写共享总线累加计时 / ASW-切M/N 共享块 GM首读1次+L2重复读(n-1)次、场景按单batch判定、分组预算不再除B / StreamK 按plan实际tile芯片口径评估 / 降核线性带宽假设文档标注
This commit is contained in:
@@ -66,11 +66,10 @@ class PlanEvaluator:
|
||||
if not res.feasible:
|
||||
tips.append("方案违反硬件约束, 需先修正: " + res.violations)
|
||||
bn = t.bottleneck
|
||||
if bn == "MTE2_GM":
|
||||
tips.append("瓶颈在 GM 搬入: 可考虑增大 tile 提升 dValue/单核搬移量, "
|
||||
"或利用 L2 驻留吸收重复读 (MergeBatch/ASW swizzle 方向)")
|
||||
elif bn == "MTE2_L2":
|
||||
tips.append("瓶颈在 L2 重复读: 优化核间分配/swizzle 窗口压低活跃工作集")
|
||||
if bn == "MTE2":
|
||||
tips.append("瓶颈在 MTE2 搬移链 (GM 读写共享总线 + L2 重复读): 可增大 tile "
|
||||
"提升 dValue/单核搬移量、利用 L2 驻留吸收重复读 (ASW swizzle/"
|
||||
"分组方向), 或评估输出驻留 L2 以减少 GM 直写与读竞争")
|
||||
elif bn == "MMAD":
|
||||
tips.append("瓶颈在 Cube 计算: 已接近理论算力上限, 检查是否有冗余计算 "
|
||||
"(MergeBatch 交叉项) 可消除")
|
||||
|
||||
Reference in New Issue
Block a user