SDXL inference optimisation study

SDXL Inference Optimisation

View Code on GitHub
Generative AI Diffusion Models Quantisation Feature Caching Benchmarking

A controlled benchmarking study of methods for reducing SDXL image-generation latency and memory use while measuring the effect on output quality.

Experiment

Results

Tech Stack

Python, PyTorch, Stable Diffusion XL, Diffusers, quantisation, feature caching, model compilation and CLIP-based evaluation.