by sosoj92
Assistant vocal local en francais : Claude ou Ollama (offline), domotique Hue, OBS, agenda, navigateur, appels Twilio, serveur MCP. Python.
# Add to your Claude Code skills
git clone https://github.com/sosoj92/jarvis-assistant-vocalGuides for using ai agents skills like jarvis-assistant-vocal.
Last scanned: 8/9/2026
{
"issues": [],
"status": "PASSED",
"scannedAt": "2026-08-09T05:04:13.694Z",
"npmAuditRan": true,
"pipAuditRan": false,
"promptInjectionRan": true
}See how jarvis-assistant-vocal compares with popular alternatives.
jarvis-assistant-vocal is an open-source ai agents skill for AI coding assistants such as Claude Code, Codex CLI, and ChatGPT, built by sosoj92. Assistant vocal local en francais : Claude ou Ollama (offline), domotique Hue, OBS, agenda, navigateur, appels Twilio, serveur MCP. Python. It has 250 GitHub stars.
Yes. jarvis-assistant-vocal passed SkillsLLM's automated security scan — a dependency vulnerability audit plus prompt-injection heuristics — with no high-severity issues. You can read the full report in the Security Report section on this page.
Clone the repository with "git clone https://github.com/sosoj92/jarvis-assistant-vocal" and add it to your Claude Code skills directory (see the Installation section above).
jarvis-assistant-vocal is primarily written in Python. It is open-source under sosoj92 on GitHub, so you can review or fork the full source.
Yes. SkillsLLM lists many other AI Agents skills you can browse and compare side by side. Open the AI Agents category from the badge at the top of this page, or use the Related Skills and comparison links further down to weigh jarvis-assistant-vocal against similar tools.
No comments yet. Be the first to share your thoughts!
⚠️ Third-Party Software Notice
This skill is third-party open-source software developed and hosted independently on GitHub. SkillsLLM is an informational directory and does not control or maintain the underlying repository.
Any security checks, ratings, or warnings displayed by SkillsLLM are automated and limited in scope. They do not constitute a security certification or guarantee that the software is safe, error-free, or free from malicious code, vulnerabilities, compromised dependencies, or prompt-injection risks.
Review the source code, permissions, dependencies, and configuration before installing or running any third-party skill. Use is at your own risk. To the maximum extent permitted by applicable law, SkillsLLM is not liable for losses arising from third-party software.
Un assistant vocal en français qui tourne sur ta machine. Dis « Hey Jarvis », parle naturellement : il raisonne avec un LLM, utilise une boîte à outils extensible (domotique, PC, web, téléphone…) et te répond à voix haute. Deux modes au choix, en une ligne de config : cloud (Claude + ElevenLabs) ou 100 % local hors ligne (Ollama + Piper).
🧠 Jarvis + Hermes. Pour la réflexion de fond et la recherche, Jarvis délègue à Hermes, un agent délibératif qui tourne en local (conteneur Docker). La doctrine est nette : Hermes orchestre et pense ; Jarvis détient les clés et le corps — c'est toujours Jarvis qui exécute les actions, jamais Hermes, et aucun identifiant ne vit dans l'environnement d'Hermes (il lit le Vault et les outils sûrs, écrit seulement des brouillons).
Projet perso partagé tel quel. Cible Windows 11, nécessite un micro et (en mode cloud) une clé API Anthropic. La plupart des intégrations sont optionnelles et se désactivent proprement si non configurées.
/panneau) — modèles (LLM Ollama + Whisper, reco selon la VRAM), état de la chaîne, permissions — accessible en local uniquement (docs/panneau.md)📺 Vidéo / GIF de démo à venir — placeholder.
flowchart LR
Mic([🎙️ Micro]) --> WW[openWakeWord<br/>« Hey Jarvis »]
WW --> STT[faster-whisper<br/>STT — local]
STT --> LLM{{LLM<br/>Claude ☁️ OU Ollama 🏠}}
LLM <-->|appels d'outils| TOOLS[🧰 Outils]
LLM --> TTS{{TTS<br/>ElevenLabs ☁️ OU Piper 🏠}}
TTS --> SPK([🔊 Haut-parleurs])
TOOLS -.-> HOME[💡 Hue / 🎬 OBS / 🖥️ PC]
TOOLS -.-> NET[📅 Agenda / 📧 Mail / 💬 Discord / 📸 Instagram]
TOOLS -.-> CDP[🌐 Chrome via CDP]
TOOLS -.-> TW[📞 Appels Twilio]
TOOLS -.->|délègue la réflexion| HERMES[🧠 Hermes<br/>agent délibératif local]
TOOLS -.-> MCP[[🔌 Serveur MCP]]
HERMES -.->|lit les outils sûrs| MCP
MCP -.-> EXT[Claude Desktop / autres clients]
PANEL[🧭 Panneau web local<br/>modèles · état · permissions] -.-> TOOLS
Jarvis tient les clés & le corps (il exécute) ; Hermes pense (réflexion, recherche, analyse du Vault). Hermes ne voit que les outils sûrs exposés par le serveur MCP de Jarvis.
| cloud (défaut) | local (hors ligne) | |
|---|---|---|
| LLM | Claude (API Anthropic) | Ollama (qwen3.5:4b…) |
| Voix | ElevenLabs | Piper (français) |
| Transcription | faster-whisper (local) | faster-whisper (local) |
| Qualité | maximale | bonne (selon le modèle) |
| Coût | à l'usage | gratuit |
| Vie privée | appels API | rien ne sort de la machine |
| Matériel | léger | GPU recommandé |
Bascule en une ligne : mode: local, hybride (défaut) ou qualite — ou à la voix « passe en local ». Voir docs/local.md et docs/costs.md
pour le bilan honnête de fiabilité (un modèle 7B gère bien les outils domotique/PC ;
les features à vision comme le navigateur & les réservations restent cloud recommandé).
Matériel local (honnête) : Whisper medium ≈ 2–3 Go VRAM, qwen3.5:4b (Q4) ≈ 3 Go —
une carte 6 Go (RTX 2060/3060) fait tourner les deux confortablement. Le qwen3.5:9b
(~6 Go) demande plus de marge. Piper est temps réel sur CPU. python scripts/doctor.py
conseille le modèle selon ta VRAM.
Prérequis : Python 3.13, uv, Windows 11, un micro.
uv sync
uv run playwright install chromium # pour les réservations / le navigateur
copy config.example.yaml config.yaml # puis remplis ce dont tu as besoin
uv run python jarvis14.py
Dis « Hey Jarvis ». Le seul réglage strictement requis est anthropic.cle (mode
cloud) ou un modèle local (mode local). Tout le reste est optionnel.
Débutant complet ? Vois INSTALL_WITH_AI.md — à coller dans
n'importe quelle IA gratuite, elle t'installe tout pas à pas. Ou lance l'installateur
interactif : python scripts/setup.py. Un souci ? python scripts/doctor.py diagnostique.
Pour INSTALLER (aucune connaissance requise) — l'option zéro friction : ouvre n'importe quel chatbot gratuit (Claude.ai, ChatGPT, Gemini), colle le contenu de INSTALL_WITH_AI.md, et laisse-toi guider.
Pour MODIFIER / bidouiller le code, plusieurs options gratuites :
Aucun outil n'est imposé : prends celui qui te convient.
Tout est dans un unique config.yaml non versionné (copié depuis
config.example.yaml, qui documente chaque clé). Nouvelles sections côté config :
hermes (délégation), integrations/hub (Vault + génération), suivi (pipeline
de contenus), securite.toujours (autorisations N2 mémorisées), budget.prix
(coût LLM), serveur/pont_iphone. Guides par intégration :
| Intégration | Guide |
|---|---|
| Cloud vs local, Ollama, Piper | docs/local.md |
| Routage 4 backends, coûts & budgets | docs/costs.md |
| Philips Hue | docs/hue.md |
| OBS | docs/obs.md |
| Google Agenda + iCal | docs/agenda.md |
| Détection de présence | docs/presence.md |
| Bot Discord | docs/discord.md |
| Appels Twilio | docs/appels.md |
| Navigateur (Chrome CDP) | docs/navigateur.md |
| Rése |