Install orpheus-cpp for CPU-based streaming inference
mainTo perform streaming audio inference without a GPU, use the orpheus-cpp backend. This requires installing orpheus-cpp and a CPU-optimized version of llama-cpp-python depending on your operating system.
Installation Steps
Install orpheus-cpp
pip install orpheus-cppInstall llama-cpp-python
- Linux/Windows (CPU):
pip install llama-cpp-python --extra-index-url https://abetlen.github.io/llama-cpp-python/whl/cpu - MacOS (Apple Silicon/Metal):
pip install llama-cpp-python --extra-index-url https://abetlen.github.io/llama-cpp-python/whl/metal
- Linux/Windows (CPU):
pip install orpheus-cpp
# For Linux/Windows
pip install llama-cpp-python --extra-index-url https://abetlen.github.io/llama-cpp-python/whl/cpu
# For MacOS Apple Silicon
pip install llama-cpp-python --extra-index-url https://abetlen.github.io/llama-cpp-python/whl/metal