Axel Remillat
← Retour aux projets

En construction//Architecture

Infrastructure IA self-hosted

Mon propre serveur GPU de production : Docker, LLM local, API TTS, tunnel sécurisé, monitoring, backups.

Pipeline // flux de données

1
Internet
tunnel sécurisé (HTTPS)
2
Reverse proxy
API TTS self-hostedOllama — LLM localServices Docker
3
Supervision
monitoring + alertes · backups planifiés
4
Serveur GPU (RTX)
production

01 // Contexte

Tout louer à des API tierces (LLM, TTS, hébergement) plafonne les marges et crée une dépendance. Je veux opérer moi-même l'infrastructure que je vends à mes clients — et pouvoir le prouver.

02 // Le défi

Monter un serveur GPU de production maison : conteneurisation, LLM local, API de synthèse vocale, exposition sécurisée vers l'extérieur, supervision et sauvegardes. Reproductible et fiable, pas un montage jetable.

03 // Résultat / état

En construction. Cible : serveur GPU (RTX) sous Docker, LLM local via Ollama, API TTS self-hosted, tunnel sécurisé, monitoring et backups planifiés. Objectif assumé : « j'opère ce que je vends ». Statut : socle en cours de montage.