¡Buena pregunta @fconsidine2! Con 11GB de VRAM deberías poder ir más rápido.
Ollama está bien para empezar, pero si quieres optimizar al máximo, te recomiendo usar directamente llama.cpp. Busca el modelo en formato GGUF. Para Llama 3 8B, la cuantización Q4_K_M suele ser el punto dulce entre velocidad y calidad. Deberías poder cargar casi todo el modelo en esa 1080Ti.