Strata faz o modelo de 125B Qwen3.8-Flash-Next rodar em GPUs de 12GB via offloading entre VRAM, RAM e CPU, com API compatível ...