by sosoj92
Assistant vocal local en francais : Claude ou Ollama (offline), domotique Hue, OBS, agenda, navigateur, appels Twilio, serveur MCP. Python.
# Add to your Claude Code skills
git clone https://github.com/sosoj92/jarvis-assistant-vocalGuides for using ai agents skills like jarvis-assistant-vocal.
Last scanned: 8/9/2026
{
"issues": [],
"status": "PASSED",
"scannedAt": "2026-08-09T05:04:13.694Z",
"npmAuditRan": true,
"pipAuditRan": false,
"promptInjectionRan": true
}See how jarvis-assistant-vocal compares with popular alternatives.
jarvis-assistant-vocal is an open-source ai agents skill for AI coding assistants such as Claude Code, Codex CLI, and ChatGPT, built by sosoj92. Assistant vocal local en francais : Claude ou Ollama (offline), domotique Hue, OBS, agenda, navigateur, appels Twilio, serveur MCP. Python. It has 373 GitHub stars.
Yes. jarvis-assistant-vocal passed SkillsLLM's automated security scan — a dependency vulnerability audit plus prompt-injection heuristics — with no high-severity issues. You can read the full report in the Security Report section on this page.
Clone the repository with "git clone https://github.com/sosoj92/jarvis-assistant-vocal" and add it to your Claude Code skills directory (see the Installation section above).
jarvis-assistant-vocal is primarily written in Python. It is open-source under sosoj92 on GitHub, so you can review or fork the full source.
Yes. SkillsLLM lists many other AI Agents skills you can browse and compare side by side. Open the AI Agents category from the badge at the top of this page, or use the Related Skills and comparison links further down to weigh jarvis-assistant-vocal against similar tools.
No comments yet. Be the first to share your thoughts!
⚠️ Third-Party Software Notice
This skill is third-party open-source software developed and hosted independently on GitHub. SkillsLLM is an informational directory and does not control or maintain the underlying repository.
Any security checks, ratings, or warnings displayed by SkillsLLM are automated and limited in scope. They do not constitute a security certification or guarantee that the software is safe, error-free, or free from malicious code, vulnerabilities, compromised dependencies, or prompt-injection risks.
Review the source code, permissions, dependencies, and configuration before installing or running any third-party skill. Use is at your own risk. To the maximum extent permitted by applicable law, SkillsLLM is not liable for losses arising from third-party software.
Un assistant vocal en français qui tourne sur ta machine. Dis « Hey Jarvis », parle naturellement : il raisonne avec un LLM, utilise une boîte à outils extensible (domotique, PC, web, téléphone…) et te répond à voix haute. Trois modes distincts : hybride (IA cloud quotidienne + Hermes pour le fond), qualité (modèle cloud le plus puissant configuré) ou 100 % local hors ligne (Ollama + voix locale). Le LLM et la voix se choisissent séparément. OpenAI et Claude/Anthropic sont intégrés aujourd'hui ; d'autres fournisseurs, comme Gemini, peuvent être ajoutés par connecteur sans changer ces trois modes.
🧠 Jarvis + Hermes. Pour la réflexion de fond et la recherche, Jarvis délègue à Hermes, un agent délibératif qui tourne en local (conteneur Docker). La doctrine est nette : Hermes orchestre et pense ; Jarvis détient les clés et le corps — c'est toujours Jarvis qui exécute les actions, jamais Hermes, et aucun identifiant ne vit dans l'environnement d'Hermes (il lit le Vault et les outils sûrs, écrit seulement des brouillons).
📡 Jarvis dans chaque pièce. Ajoute un ou plusieurs satellites audio réseau pour déporter le micro et le haut-parleur dans la cuisine, le salon ou une autre pièce. Le PC reste le cerveau central ; aucun long câble ne le relie aux pièces. Le client disponible aujourd'hui cible Raspberry Pi/Linux, mais le protocole est prévu pour accueillir des solutions moins chères : ancien téléphone Android, ESP32 avec audio ou Pi Zero (options et fonctionnement · guide de choix et d'installation · installation Raspberry/Linux détaillée).
Projet perso partagé tel quel. Cible Windows 11, nécessite un micro et (en mode cloud) une clé API du fournisseur choisi. Les abonnements grand public et les API sont généralement séparés. La plupart des intégrations sont optionnelles et se désactivent proprement si non configurées.
/panneau) — commandes rapides de modèle/voix, état de la chaîne, réglages et permissions — accessibles en local uniquement (docs/panneau.md)📺 Vidéo / GIF de démo à venir — placeholder.
flowchart LR
Mic([🎙️ Micro]) --> WW[openWakeWord<br/>« Hey Jarvis »]
WW --> STT[faster-whisper<br/>STT — local]
STT --> LLM{{LLM<br/>Cloud configurable ☁️<br/>OU Ollama 🏠}}
LLM <-->|appels d'outils| TOOLS[🧰 Outils]
LLM --> TTS{{Voix configurable<br/>ElevenLabs · Piper · Kokoro · Windows}}
TTS --> SPK([🔊 Haut-parleurs])
SAT([📡 Satellite audio réseau<br/>Android · ESP32 · Linux]) -->|audio LAN authentifié| STT
TTS -->|audio LAN| SAT
CAM([📷 Webcam optionnelle]) --> GEST[✋ Gestes locaux]
GEST --> TOOLS
TOOLS -.-> HOME[💡 Hue / 🎬 OBS / 🖥️ PC]
TOOLS -.-> NET[📅 Agenda / 📧 Mail / 💬 Discord / 📸 Instagram]
TOOLS -.-> CDP[🌐 Chrome via CDP]
TOOLS -.-> TW[📞 Appels Twilio]
TOOLS -.->|délègue la réflexion| HERMES[🧠 Hermes<br/>agent délibératif local]
TOOLS -.-> MCP[[🔌 Serveur MCP]]
HERMES -.->|lit les outils sûrs| MCP
MCP -.-> EXT[Claude Desktop / autres clients]
PANEL[🧭 Panneau web local<br/>modèles · état · permissions] -.-> TOOLS
Jarvis tient les clés & le corps (il exécute) ; Hermes pense (réflexion, recherche, analyse du Vault). Hermes ne voit que les outils sûrs exposés par le serveur MCP de Jarvis.
| Mode | LLM | Voix | Usage |
|---|---|---|---|
| hybride (défaut) | profil quotidien OpenAI ou Claude/Anthropic | moteur choisi séparément | demandes courtes en cloud, tâches de fond confiées à Hermes |
| qualité | profil le plus puissant du même fournisseur | moteur choisi séparément | demandes exigeantes et raisonnement renforcé |
| local | Ollama (qwen3.5:4b…) |
Piper, Kokoro ou Windows | 100 % hors ligne, aucune API et aucun coût d'usage |
La transcription faster-whisper reste locale dans les trois modes.
Petit budget cloud ? Le mode local est disponible aujourd'hui sans coût d'API. Des connecteurs optionnels Gemini (niveau gratuit) et DeepSeek (paiement à l'usage économique) sont proposés dans la roadmap, mais ne sont pas encore intégrés. Le projet, les limites et les précautions de confidentialité sont détaillés dans le guide des coûts.
Bascule en une ligne : mode: local, hybride (défaut) ou qualite — ou à la voix « passe en local ». Voir docs/local.md et docs/costs.md
pour le bilan honnête de fiabilité (un modèle 7B gère bien les outils domotique/PC ;
les features à vision comme le navigateur & les réservations restent cloud recommandé).
Matériel local (honnête) : Whisper medium ≈ 2–3 Go VRAM, qwen3.5:4b (Q4) ≈ 3 Go —
une carte 6 Go (RTX 2060/3060) fait tourner les deux confortablement. Le qwen3.5:9b
(~6 Go) demande plus de marge. Piper est temps réel