by sosoj92
Assistant vocal local en francais : Claude ou Ollama (offline), domotique Hue, OBS, agenda, navigateur, appels Twilio, serveur MCP. Python.
# Add to your Claude Code skills
git clone https://github.com/sosoj92/jarvis-assistant-vocalGuides for using ai agents skills like jarvis-assistant-vocal.
jarvis-assistant-vocal is an open-source ai agents skill for AI coding assistants such as Claude Code, Codex CLI, and ChatGPT, built by sosoj92. Assistant vocal local en francais : Claude ou Ollama (offline), domotique Hue, OBS, agenda, navigateur, appels Twilio, serveur MCP. Python. It has 64 GitHub stars.
jarvis-assistant-vocal's catalog security scan is still queued. You can run an instant dependency and prompt-injection check now with the "Scan for vulnerabilities" button above.
Clone the repository with "git clone https://github.com/sosoj92/jarvis-assistant-vocal" and add it to your Claude Code skills directory (see the Installation section above).
jarvis-assistant-vocal is primarily written in Python. It is open-source under sosoj92 on GitHub, so you can review or fork the full source.
Yes. SkillsLLM lists many other AI Agents skills you can browse and compare side by side. Open the AI Agents category from the badge at the top of this page, or use the Related Skills and comparison links further down to weigh jarvis-assistant-vocal against similar tools.
No comments yet. Be the first to share your thoughts!
Unlocks once the catalog security scan passes (runs nightly).
The deep catalog scan for this skill is still queued. Run an instant dependency check now instead.
Un assistant vocal en français qui tourne sur ta machine. Dis « Hey Jarvis », parle naturellement : il raisonne avec un LLM, utilise une boîte à outils extensible (domotique, PC, web, téléphone…) et te répond à voix haute. Deux modes au choix, en une ligne de config : cloud (Claude + ElevenLabs) ou 100 % local hors ligne (Ollama + Piper).
Projet perso partagé tel quel. Cible Windows 11, nécessite un micro et (en mode cloud) une clé API Anthropic. La plupart des intégrations sont optionnelles et se désactivent proprement si non configurées.
📺 Vidéo / GIF de démo à venir — placeholder.
flowchart LR
Mic([🎙️ Micro]) --> WW[openWakeWord<br/>« Hey Jarvis »]
WW --> STT[faster-whisper<br/>STT — local]
STT --> LLM{{LLM<br/>Claude ☁️ OU Ollama 🏠}}
LLM <-->|appels d'outils| TOOLS[🧰 Outils]
LLM --> TTS{{TTS<br/>ElevenLabs ☁️ OU Piper 🏠}}
TTS --> SPK([🔊 Haut-parleurs])
TOOLS -.-> HOME[💡 Hue / 🎬 OBS / 🖥️ PC]
TOOLS -.-> NET[📅 Agenda / 📧 Mail / 💬 Discord / 📸 Instagram]
TOOLS -.-> CDP[🌐 Chrome via CDP]
TOOLS -.-> TW[📞 Appels Twilio]
TOOLS -.-> MCP[[🔌 Serveur MCP]]
MCP -.-> EXT[Hermes Agent / Claude Desktop]
| cloud (défaut) | local (hors ligne) | |
|---|---|---|
| LLM | Claude (API Anthropic) | Ollama (qwen3.5:4b…) |
| Voix | ElevenLabs | Piper (français) |
| Transcription | faster-whisper (local) | faster-whisper (local) |
| Qualité | maximale | bonne (selon le modèle) |
| Coût | à l'usage | gratuit |
| Vie privée | appels API | rien ne sort de la machine |
| Matériel | léger | GPU recommandé |
Bascule en une ligne : mode: cloud ou mode: local. Voir docs/local.md
pour le bilan honnête de fiabilité (un modèle 7B gère bien les outils domotique/PC ;
les features à vision comme le navigateur & les réservations restent cloud recommandé).
Matériel local (honnête) : Whisper medium ≈ 2–3 Go VRAM, qwen3.5:4b (Q4) ≈ 3 Go —
une carte 6 Go (RTX 2060/3060) fait tourner les deux confortablement. Le qwen3.5:9b
(~6 Go) demande plus de marge. Piper est temps réel sur CPU. python scripts/doctor.py
conseille le modèle selon ta VRAM.
Prérequis : Python 3.13, uv, Windows 11, un micro.
uv sync
uv run playwright install chromium # pour les réservations / le navigateur
copy config.example.yaml config.yaml # puis remplis ce dont tu as besoin
uv run python jarvis14.py
Dis « Hey Jarvis ». Le seul réglage strictement requis est anthropic.cle (mode
cloud) ou un modèle local (mode local). Tout le reste est optionnel.
Débutant complet ? Vois INSTALL_WITH_AI.md — à coller dans
n'importe quelle IA gratuite, elle t'installe tout pas à pas. Ou lance l'installateur
interactif : python scripts/setup.py. Un souci ? python scripts/doctor.py diagnostique.
Pour INSTALLER (aucune connaissance requise) — l'option zéro friction : ouvre n'importe quel chatbot gratuit (Claude.ai, ChatGPT, Gemini), colle le contenu de INSTALL_WITH_AI.md, et laisse-toi guider.
Pour MODIFIER / bidouiller le code, plusieurs options gratuites :
Aucun outil n'est imposé : prends celui qui te convient.
Tout est dans un unique config.yaml non versionné (copié depuis
config.example.yaml, qui documente chaque clé). Guides par intégration :
| Intégration | Guide |
|---|---|
| Cloud vs local, Ollama, Piper | docs/local.md |
| Philips Hue | docs/hue.md |
| OBS | docs/obs.md |
| Google Agenda + iCal | docs/agenda.md |
| Détection de présence | docs/presence.md |
| Bot Discord | docs/discord.md |
| Appels Twilio | docs/appels.md |
| Navigateur (Chrome CDP) | docs/navigateur.md |
| Réservations web | docs/reservation.md |
| docs/instagram.md | |
| Serveur MCP | docs/mcp.md |
| Latence perçue (UX) | docs/latency.md |
La confiance est intégrée, pas rajoutée :
config.yaml, mémoire, logs, transcriptions d'appels, tokens OAuth — tous gitignorés).qwen3.5 lit déjà le texte des boutons (testé) — reste à valider le pilotage completAjouter un outil = un seul fichier dans tools/ avec un décorateur @outil(...) — il
est auto-découvert, aucun câblage. Issues et PR bienvenues. Merci de ne jamais committer
de vrais secrets (vois .gitignore).
MIT — voir LICENSE.