llamacpp에 DFlash가 통합 되서,
baik bekerja dengan Qwen 3.6.
Dari Strix Halo yang lambat, berdasarkan Q6KL
27B : 15-16tps -> 15-23tps naik turun
35BA3B: 60tps -> 60-90tps naik turun
Karena memorinya masih tersisa, DFlash bisa dinaikkan, tapi setelah dicoba, model difusi seperti ini
terasa kurang rapi dan kurang cerdas ;;
Untuk model MoE sepertinya tidak bisa memahami ucapan dengan benar