5 lines
179 B
Markdown
5 lines
179 B
Markdown
llama.cpp is good for cpu/gpu inferencing
|
|
vllm is good for tensor parallelism
|
|
ollama sits on top of llama.cpp and shares most of its advantages and shortcomings
|
|
|
|
#ai #llama #vllm |