leejet
|
0a9340c599
|
fix: scale Qwen Image 2.1 VAE convolutions (#2054)
|
2026-09-25 15:52:35 +08:00 |
|
leejet
|
740c7ae193
|
feat: add configurable Qwen cache types and early cache scheduling (#2045)
|
2026-09-25 01:51:01 +08:00 |
|
leejet
|
187b2561ea
|
feat: add native CUDA SageAttention support (#2005)
|
2026-09-21 01:16:59 +08:00 |
|
leejet
|
1330cebae8
|
feat: support building with upstream ggml (#1999)
|
2026-09-19 22:25:01 +08:00 |
|
leejet
|
3e037a81e4
|
perf: accelerate VAE direct 3D convolutions (#1996)
|
2026-09-19 17:50:01 +08:00 |
|
leejet
|
adcac69650
|
perf: pad small attention heads to 64 for MMA Flash Attention (#1992)
|
2026-09-18 23:59:58 +08:00 |
|
George
|
0bd72f075a
|
feat: add Wan2.2 S2V (audio+img-to-video) support (#1925)
Co-authored-by: leejet <leejet714@gmail.com>
|
2026-09-13 23:33:50 +08:00 |
|
leejet
|
31ab2b2e08
|
refactor: split ggml extensions and move implementations to cpp files (#1945)
|
2026-09-07 23:34:45 +08:00 |
|