Public Access
909e2e995ae6b748eb8e89c9d2841d17cc7f5e06
Aethas38 - Multi-IA Orchestrateur (Minecraft-Tech Edition)
Plateforme SaaS d'IA modulaire : Orchestrateur local, routeur intelligent, sécurisé et facturable.
📋 To-Do List (Roadmap)
Phase 1 & 2 : Infrastructure & Backend de Base ✅
- Installation Docker, Nginx, Pare-feu, Gitea/GitHub
- Serveur Local Ollama (Qwen 3B) + FastHTML
- Routeur Multi-IA (Groq, Gemini, Local) avec système de cascade et directives d'aiguillage strictes
- Continuité de service : IA de secours (Fallback automatique sur Groq) en cas de panne d'une API primaire
Phase 3 : Refonte UI & Expérience Utilisateur ✅
- Thème "Minecraft-Tech" (Inspiré serveurs/redstone) compatible Mobile (Responsive)
- Historique (Sidebar) avec Renommage, Épinglage, Suppression et Navigation isolée par session
- Zone de saisie intelligente (Textarea auto-adaptatif, Drag & Drop avec pills/miniatures, Collage multi-fichiers jusqu'à 10)
- Export modulaire et propre (PDF Pro avec fond blanc, DOC Word, TXT, JSON, et blocs de code en ZIP) avec nommage dynamique intelligent basé sur la requête utilisateur (ex:
frise_temporalite_minecraft.pdf) - Boutons de partage direct (WhatsApp, Email) avec nettoyage automatique des balises HTML brutes
- Script de nettoyage automatique : Suppression des discussions de > 365 jours
- Indicateur d'avancement dynamique (Loader Néon) pendant le traitement des IA
- Architecture modulaire propre (Dossier
modules/isolant Database, Scraper, AI Engine, Router et UI)
Phase 4 : Gestion des Utilisateurs & Sécurité
- Céer un lien Paypal pour les dons des utilisateurs.
- Mettre en place une bibliothèque logiciel à installer avec le serveur (déporter tout ce qui peut l'être comme la création de pdf, docx, html, etc.)
- Choix entre l'utilisation de la version payante ou gratuite. Routage suivant le choix.
- Système de connexion sécurisé (Mots de passe cryptés)
- Fail2Ban (Blocage 15 mins après 5 erreurs)
- Intégration SMTP (
mail.aethas38.duckdns.org) pour mot de passe oublié et notifications de thèmes spécifiques - Gestion des rôles : Admin (Xavier, Céline), Famille (Anaëlle, Audric, Renan), Testeur (Nogapra) et Externes. Testeur juste accès à la partie gratuite.
- Prévoir un script automatique envoyant un mail sympathique aux utilisateurs lors de leur anniversaire.
Phase 5 : Sécurité Financière & Facturation Exacte 💰
- Modèle Excel de calcul des coûts serveur (1x 1000W H24, Internet 60€/mois). Prendre en compte le tarif réglemanté de l'électricité en France et la consommation réel du serveur.
- Simulateur de coût avant requête : L'estimation doit être exacte pour éviter les défauts de paiement
- Gestion des comptes et provisions (CB) avec test du restant financier avant validation
- Règles d'exceptions Administrateurs & Famille (Pas de provision nécessaire, rattachés au master-compte Xavier/Céline)
- Majoration invisible de 15% appliquée automatiquement pour les comptes Externes
- Compteur en temps réel mis à jour après la requête basé sur le prix annoncé après traitement par les fournisseurs "Pay As You Go" (PAYG)
- Routage Conditionnel Payant : Utiliser toutes les IA en adéquation avec le thème de la requête
Phase 6 : Nouvelles Capacités IA (Spécialisations & Modèles) 🤖
La mise en forme finale des retours est assurée par l'abonnement Gemini.
| Domaine de tâche | Modèle / Moteur | Fournisseur / Hébergement | Rôle principal |
|---|---|---|---|
| Orchestration & Tri | Qwen 2.5 (3B/7B quantizé) | Local (GTX 1650 / Ollama) | Analyse l'intention, gère le chat rapide et route vers la bonne IA |
| Prog. & Java 21 | Claude 3.5 Sonnet / Qwen Coder | Anthropic / OpenRouter | Correction bugs, KubeJS, modernisation de mods (Pay-as-you-go) |
| Serveur / Logs | Llama 3.3 (8B / 70B) | Groq API | Analyse crashs Prism Launcher, Bash, Docker (Gratuit / Rapide) |
| Logique & Quêtes | DeepSeek R1 (Distillé) | DeepSeek API / Gratuit | Structuration logique des modpacks et FTB Quests |
| Images HD / Vidéo | Gemini 2.0 Flash / FLUX.1 | Google AI Studio & Fal.ai | Analyse d'images/vidéos et génération d'assets 2K |
| Bureautique | À définir | À définir | Excel (Macros, formules complexes) |
Phase 7 : RAG & Maintenance
- "RAG" : Base de données vectorielle (ChromaDB) pour permettre l'apprentissage et la mémorisation de l'IA locale
- Script de surveillance de l'espace disque du serveur. Affichage d'une barre d'état (statuts des disques, remplissage, utilisations pour Xavier)
- Création de logs centralisés consultables et téléchargeables par l'Admin
Phase 8 : Déploiement Public & Configuration
- Assistant de configuration (Wizard) au premier lancement pour insérer les clés API, configurer le SMTP, etc.
- Liens de documentation intégrés pour créer ses propres clés API
- Hébergement sur Gitea/Github des versions "Install Initial" ou "Update" pour Docker
📷 Vidéosurveillance & Détection Intelligente
L'écosystème de vision par ordinateur appliqué à la sécurité s'articule autour de la détection d'objets en temps réel pour garantir des alertes immédiates[cite: 35].
1. Frigate NVR (Détection Locale & Temps Réel)
- Rôle principal : Solution standard incontournable pour analyser des flux vidéo RTSP 24h/24 en local, sans saturer le processeur et sans dépendre du cloud[cite: 35].
- Matériel recommandé : Ajout d'un accélérateur matériel Google Coral TPU (M.2 ou USB) pour encaisser le traitement lourd de l'IA sans impacter le CPU du serveur[cite: 35].
- Modèles de détection :
- Modèle par défaut : Basé sur MobileNet SSD, optimisé pour les Edge TPU, détectant les classes standard (personnes, voitures, chats, chiens)[cite: 35].
- Modèles personnalisés (YOLO) : Injection possible de modèles au format
.onnx(issus de YOLOv5, v8 ou v11) pour des éléments spécifiques (colis, animaux précis)[cite: 35]. - Frigate+ : Service payant d'annotation de faux positifs pour réentraîner un modèle sur-mesure ultra-précis pour le Coral TPU[cite: 35].
🏠 Home Assistant & Analyse Sémantique (LLM Multimodaux)
L'utilisation de Modèles de Langage Multimodaux (LMM) permet de comprendre en détail le contenu d'une scène et d'envoyer des notifications contextuelles riches[cite: 35].
1. Solutions Cloud (Précision Maximale)
- Google Gemini (Flash / Pro) : Choix populaire et redoutable doté de quotas gratuits généreux, capable de décrire une image avec une précision chirurgicale (ex. : « Un livreur dépose un colis étiqueté Amazon sur le paillasson »)[cite: 35].
- OpenAI GPT-4o / GPT-4o-mini : Alternative payante performante pour analyser le contexte d'une image et générer des notifications smartphone dynamiques[cite: 35].
2. Solutions Locales (Confidentialité / 100% Offline)
- Qwen2-VL : L'un des meilleurs modèles ouverts (open-weights) en vision pour analyser finement les détails d'une caméra de sécurité[cite: 35].
- Llama 3.2 Vision : Modèle rapide et idéal pour un déploiement local sur une machine dotée d'un GPU performant[cite: 35].
- Moondream : Modèle minuscule et ultrarapide conçu spécifiquement pour la vision sur des architectures modestes[cite: 35].
3. Architecture Hybride Recommandée
- Niveau 1 (Sécurité & Réactivité - 0ms de latence cloud) : Frigate couplé au Google Coral TPU surveille les flux en continu et déclenche instantanément des actions physiques (lumières, alarmes) via Home Assistant dès qu'un humain est détecté[cite: 35].
- Niveau 2 (Confort & Notification - Analyse sémantique) : Home Assistant capture une image (snapshot) et l'envoie à un LLM multimodal (Gemini pour le cloud ou Qwen2-VL en local) pour générer une notification push riche décrivant la situation[cite: 35].
Languages
Python
99.3%
Dockerfile
0.4%
PowerShell
0.3%