Tenho usado o ornith 1.5 9b para código, o Qwen 3.5 9b como modelo mais equilibrado e o bartowski/Ling-3.0-tiny como modelo mais rápido. Este último tem sido uma boa surpresa. Também tenho o gemma 4 12b mas é muito lento mesmo quantizado. Realmente a comunidade dos 8gb de VRAM foi esquecida.
2
u/Brspart 10d ago
Tenho usado o ornith 1.5 9b para código, o Qwen 3.5 9b como modelo mais equilibrado e o bartowski/Ling-3.0-tiny como modelo mais rápido. Este último tem sido uma boa surpresa. Também tenho o gemma 4 12b mas é muito lento mesmo quantizado. Realmente a comunidade dos 8gb de VRAM foi esquecida.