Installation¶
Prérequis¶
- macOS sur Apple Silicon (M1/M2/M3/M4/M5)
- Python 3.10+
Installation avec uv (recommandée)¶
Installation avec pip¶
Optionnel : support vidéo¶
Pour le traitement vidéo avec transformers :
Optionnel : support audio (STT/TTS)¶
Optionnel : embeddings¶
Ce qui est installé¶
mlx,mlx-lm,mlx-vlm- framework MLX et bibliothèques de modèlestransformers,tokenizers- bibliothèques HuggingFaceopencv-python- traitement vidéogradio- interface de chatpsutil- surveillance des ressourcesmlx-audio(optionnel) - Speech-to-Text et Text-to-Speechmlx-embeddings(optionnel) - embeddings de texte
Vérifier l'installation¶
# Check CLI commands
vllm-mlx --help
vllm-mlx-bench --help
vllm-mlx-chat --help
# Test with a small model
vllm-mlx-bench --model mlx-community/Llama-3.2-1B-Instruct-4bit --prompts 1
Dépannage¶
MLX introuvable¶
Vérifiez que vous êtes sur Apple Silicon :
Échec du téléchargement du modèle¶
Vérifiez votre connexion internet et vos accès HuggingFace. Certains modèles nécessitent une authentification :
Mémoire insuffisante¶
Utilisez un modèle quantifié plus petit :
Interruptions du serveur pendant les exécutions longues (mise en veille de macOS)¶
Votre machine macOS peut passer en veille pendant de longues exécutions en tant que serveur. Essayez d'utiliser caffeinate pour empêcher la mise en veille :