Masih belum ada llamacpp yang di-merge,
Orang yang membuat Dflash telah membuat DFlash2 beberapa waktu lalu dan mengirimkannya sebagai PR.
Saya, yang membuat llamacpp untuk strixhalo, menggabungkannya dengan Qwen3.8 27B UD-Q5-KXL dan mencobanya, ternyata sangat bagus! -0-
Bahkan dalam kondisi konteks lebih dari 100K, kecepatannya sekitar 15t/s. Dalam keadaan kosong, terkadang bisa mencapai hampir 30.
Dengan demikian, banyak model yang ada di SSD telah dibersihkan -_-;
Qwen 3.6 35B A3B juga dibersihkan karena munculnya Orinith 1.5
Gemma4 26B masih akan saya simpan karena performanya dalam berbicara cukup baik, sedangkan Gemma4 31B telah dibersihkan.
Ling 3.0 Tiny berukuran 8B A1B dan ternyata melakukan tool call dengan sangat baik!?
Hasilnya memang sedikit berbeda tergantung penggunaannya, tetapi di unsloth studio, model ini cukup baik dalam mengumpulkan berita dan merapikan data. Tentu saja, kecepatannya juga tinggi.
Oleh karena itu, saya akan menyimpannya untuk sementara waktu..; Silahkan coba bagi yang belum pernah menggunakannya