6 ms·
if using deep learning models, consider using distilled and/or quantized models to reduce the resources required for inference
by alzaeem 6y ago
if using deep learning models, consider using distilled and/or quantized models to reduce the resources required for inference