|
|
0cd47f93cb
|
Fix #34: ASW_Basic 兜底恒出方案; 搬移效率下限不满足降级为 warning (不判违规)
- constraints.py: ASW_Basic/ASW_Basic_降核 的 dValue 效率下限不再计违规
(DMA 仍能工作只是效率低; 真正不可行的只有容量/核数硬约束);
IterBatch/MergeBatch/StreamK 等有替代分支的分支仍按违规处理 (不满足条件不该进)
- asw_basic 枚举尾部: 严格 256B 偏好无解 -> 放开约束4 按 128B 硬下限给最优可行 tile,
note 标注"效率降级"; 128B 硬下限也不满足的极端形状 (如 N=8 int8, B 侧 dValue=8B
物理不可满足) 仍给 Base tile 方案 + 标注效率降级 (搬移效率崩塌)
- evaluator advice / router 仲裁文案含"效率降级"提示 (plan.note 同步)
- docs/06 Step1 增加"兜底分支恒出方案"段落 (效率降级 vs 违规的语义分层)
- 回归: b32_m16_n8192_k7168 分解 = Base 16x1024 + tile 16x1024 + k_l1=112
(L1 双缓冲 ⌊L1/(2·(16+1024)·2)⌋16=112 反推) 入测试; 极端形状 feasible=True +
效率降级标注; 压力 10000 例 0 崩溃/0 NaN/0 硬违规/0 GM<V_in; examples 重生成 0 diff
|
2026-09-07 16:24:46 +08:00 |
|
|
|
4843053ad3
|
Fix issues #23-#25 (+#26 标注): GM读写共享总线累加计时 / ASW-切M/N 共享块 GM首读1次+L2重复读(n-1)次、场景按单batch判定、分组预算不再除B / StreamK 按plan实际tile芯片口径评估 / 降核线性带宽假设文档标注
|
2026-09-04 11:43:23 +08:00 |
|
|
|
9afe6eec02
|
Fix review issues #17-#22: 恢复 #11/#12/#14 (StreamK fixpipe 单次计账/K=1 AIV单缓冲/advice) + 占位方案不可评估 + 转置 dValue 判据三处同源(form c 双缓冲适配修复) + 恢复 #13/#15 回归测试 + 清理临时 csv/.gitignore + 文档同步
|
2026-09-03 21:10:05 +08:00 |
|
|
|
a7356fec99
|
Update BMM_Theory: bmm_theory/evaluator.py
|
2026-09-03 12:43:38 +00:00 |
|
|
|
4bedf0a109
|
Fix review issues #11-#16: StreamK fixpipe 单次计账 / K=1 AIV单缓冲方案 / MergeBatch b0 L0A/L0B 上限+路由可行回退 / advice-StreamK / 输入校验 / .gitignore+死代码清理
|
2026-09-03 20:05:14 +08:00 |
|
|
|
0c19d99d3a
|
Update BMM_Theory: bmm_theory/evaluator.py (fix review issues #4-#10)
|
2026-09-03 11:34:17 +00:00 |
|
|
|
b5ddd6c82f
|
Update BMM_Theory: bmm_theory/evaluator.py
|
2026-09-03 09:25:35 +00:00 |
|
|
|
b4433a209d
|
Add BMM_Theory: bmm_theory/evaluator.py
|
2026-09-03 08:09:24 +00:00 |
|