6 ms·
in llama.cpp inference runs on CPU, using AVX-2 optimizations. You don't need GPU at all It runs on my 2015 ThinkPad!
by danbst 3y ago
in llama.cpp inference runs on CPU, using AVX-2 optimizations. You don't need GPU at all
It runs on my 2015 ThinkPad!