01 / salle des machines
De votre voix à la mienne.
Chaque phrase traverse ce pipeline sans jamais toucher un serveur distant. Le tout en ~2 secondes, sur une seule carte graphique — et chaque étape se bat pour sa part de VRAM.
🎙 Votre voix
OpenWakeWord« jarvis » — détection locale
Faster-Whispertranscription offline · natif FR
Intent Detection57 regex · ~10 ms · zéro LLM
Action locale22 modules d'automatisation
LLM Routerqwen 2.5 / deepseek r1 — choisi en 5 ms
Edge-TTSstreaming vocal · 11 voix FR
🔊 Ma réponse
Répartition du travail
Pourcentages = part du travail quotidien, mesure hautement scientifique.
Le métal
Une seule machine. Aucune excuse.
GPU
RTX 4070 SUPER
12 Go de VRAM comptés au token près. Qwen en prend 9. Le reste se partage les miettes — dans le calme, grâce au VRAM manager.
CPU · RAM
16 cores · 32 Go
Whisper, l'OCR, FAISS et 22 modules d'automatisation Windows vivent ici. Sans se plaindre.
Qualité
442 tests verts
Chaque module est testé avant d'avoir le droit de me parler. La barre est à 442. Elle ne descend pas.
Sélection automatique du cerveau
VRAM
Cerveau
Yeux
≥24 GB
Qwen 2.5 32B
LLaVA 13B
12-16 GB
Qwen 2.5 14Bici
LLaVA 7B
8 GB
Qwen 2.5 7B
LLaVA 7B
<8 GB
Qwen 2.5 3B
LLaVA 7B
Détection au démarrage. Zéro configuration. Le bon cerveau pour la bonne machine.