Files
aethas-free/README.md
T

7.5 KiB

Aethas38 - Multi-IA Orchestrateur (Minecraft-Tech Edition)

Plateforme SaaS d'IA modulaire : Orchestrateur local, routeur intelligent, sécurisé et facturable.

📋 To-Do List (Roadmap)

Phase 1 & 2 : Infrastructure & Backend de Base ✅

  • Installation Docker, Nginx, Pare-feu, Gitea/GitHub
  • Serveur Local Ollama (Qwen 3B) + FastHTML
  • Routeur Multi-IA (Groq, Gemini, Local) avec système de cascade et directives d'aiguillage strictes
  • Continuité de service : IA de secours (Fallback automatique sur Groq) en cas de panne d'une API primaire

Phase 3 : Refonte UI & Expérience Utilisateur ✅

  • Thème "Minecraft-Tech" (Inspiré serveurs/redstone) compatible Mobile (Responsive)
  • Historique (Sidebar) avec Renommage, Épinglage, Suppression et Navigation isolée par session
  • Zone de saisie intelligente (Textarea auto-adaptatif, Drag & Drop avec pills/miniatures, Collage multi-fichiers jusqu'à 10)
  • Export modulaire et propre (PDF Pro avec fond blanc, DOC Word, TXT, JSON, et blocs de code en ZIP) avec nommage dynamique intelligent basé sur la requête utilisateur (ex: frise_temporalite_minecraft.pdf)
  • Boutons de partage direct (WhatsApp, Email) avec nettoyage automatique des balises HTML brutes
  • Script de nettoyage automatique : Suppression des discussions de > 365 jours
  • Indicateur d'avancement dynamique (Loader Néon) pendant le traitement des IA
  • Architecture modulaire propre (Dossier modules/ isolant Database, Scraper, AI Engine, Router et UI)

Phase 4 : Gestion des Utilisateurs & Sécurité

  • Mettre en place une bibliothèque lociel à installer avec le serveur
  • Choix entre l'utilisation de la version payante ou gratuite. Routage suivant le choix.
  • Système de connexion sécurisé (Mots de passe cryptés)
  • Fail2Ban (Blocage 15 mins après 5 erreurs)
  • Intégration SMTP (mail.aethas38.duckdns.org) pour mot de passe oublié et notifications de thèmes spécifiques
  • Gestion des rôles : Admin (Xavier, Céline), Famille (Anaëlle, Audric, Renan), Testeur (Nogapra) et Externes. Testeur juste accès à la partie gratuite.

Phase 5 : Sécurité Financière & Facturation Exacte 💰

  • Modèle Excel de calcul des coûts serveur (1x 1000W H24, Internet 60€/mois). Prendre en compte le tarif réglemanté de l'électricité en France et la consommation réel du serveur.
  • Simulateur de coût avant requête : L'estimation doit être exacte pour éviter les défauts de paiement
  • Gestion des comptes et provisions (CB) avec test du restant financier avant validation
  • Règles d'exceptions Administrateurs & Famille (Pas de provision nécessaire, rattachés au master-compte Xavier/Céline)
  • Majoration invisible de 15% appliquée automatiquement pour les comptes Externes
  • Compteur en temps réel mis à jour après la requête basé sur le prix annoncé après traitement par les fournisseurs "Pay As You Go" (PAYG)
  • Routage Conditionnel Payant : Utiliser toutes les IA en adéquation avec le thème de la requête

Phase 6 : Nouvelles Capacités IA (Spécialisations & Modèles) 🤖

La mise en forme finale des retours est assurée par l'abonnement Gemini.

Domaine de tâche Modèle / Moteur Fournisseur / Hébergement Rôle principal
Orchestration & Tri Qwen 2.5 (3B/7B quantizé) Local (GTX 1650 / Ollama) Analyse l'intention, gère le chat rapide et route vers la bonne IA
Prog. & Java 21 Claude 3.5 Sonnet / Qwen Coder Anthropic / OpenRouter Correction bugs, KubeJS, modernisation de mods (Pay-as-you-go)
Serveur / Logs Llama 3.3 (8B / 70B) Groq API Analyse crashs Prism Launcher, Bash, Docker (Gratuit / Rapide)
Logique & Quêtes DeepSeek R1 (Distillé) DeepSeek API / Gratuit Structuration logique des modpacks et FTB Quests
Images HD / Vidéo Gemini 2.0 Flash / FLUX.1 Google AI Studio & Fal.ai Analyse d'images/vidéos et génération d'assets 2K
Bureautique À définir À définir Excel (Macros, formules complexes)

Phase 7 : RAG & Maintenance

  • "RAG" : Base de données vectorielle (ChromaDB) pour permettre l'apprentissage et la mémorisation de l'IA locale
  • Script de surveillance de l'espace disque du serveur
  • Création de logs centralisés consultables et téléchargeables par l'Admin

Phase 8 : Déploiement Public & Configuration

  • Assistant de configuration (Wizard) au premier lancement pour insérer les clés API, configurer le SMTP, etc.
  • Liens de documentation intégrés pour créer ses propres clés API
  • Hébergement sur Gitea/Github des versions "Install Initial" ou "Update" pour Docker

📷 Vidéosurveillance & Détection Intelligente

L'écosystème de vision par ordinateur appliqué à la sécurité s'articule autour de la détection d'objets en temps réel pour garantir des alertes immédiates[cite: 35].

1. Frigate NVR (Détection Locale & Temps Réel)

  • Rôle principal : Solution standard incontournable pour analyser des flux vidéo RTSP 24h/24 en local, sans saturer le processeur et sans dépendre du cloud[cite: 35].
  • Matériel recommandé : Ajout d'un accélérateur matériel Google Coral TPU (M.2 ou USB) pour encaisser le traitement lourd de l'IA sans impacter le CPU du serveur[cite: 35].
  • Modèles de détection :
    • Modèle par défaut : Basé sur MobileNet SSD, optimisé pour les Edge TPU, détectant les classes standard (personnes, voitures, chats, chiens)[cite: 35].
    • Modèles personnalisés (YOLO) : Injection possible de modèles au format .onnx (issus de YOLOv5, v8 ou v11) pour des éléments spécifiques (colis, animaux précis)[cite: 35].
    • Frigate+ : Service payant d'annotation de faux positifs pour réentraîner un modèle sur-mesure ultra-précis pour le Coral TPU[cite: 35].

🏠 Home Assistant & Analyse Sémantique (LLM Multimodaux)

L'utilisation de Modèles de Langage Multimodaux (LMM) permet de comprendre en détail le contenu d'une scène et d'envoyer des notifications contextuelles riches[cite: 35].

1. Solutions Cloud (Précision Maximale)

  • Google Gemini (Flash / Pro) : Choix populaire et redoutable doté de quotas gratuits généreux, capable de décrire une image avec une précision chirurgicale (ex. : « Un livreur dépose un colis étiqueté Amazon sur le paillasson »)[cite: 35].
  • OpenAI GPT-4o / GPT-4o-mini : Alternative payante performante pour analyser le contexte d'une image et générer des notifications smartphone dynamiques[cite: 35].

2. Solutions Locales (Confidentialité / 100% Offline)

  • Qwen2-VL : L'un des meilleurs modèles ouverts (open-weights) en vision pour analyser finement les détails d'une caméra de sécurité[cite: 35].
  • Llama 3.2 Vision : Modèle rapide et idéal pour un déploiement local sur une machine dotée d'un GPU performant[cite: 35].
  • Moondream : Modèle minuscule et ultrarapide conçu spécifiquement pour la vision sur des architectures modestes[cite: 35].

3. Architecture Hybride Recommandée

  • Niveau 1 (Sécurité & Réactivité - 0ms de latence cloud) : Frigate couplé au Google Coral TPU surveille les flux en continu et déclenche instantanément des actions physiques (lumières, alarmes) via Home Assistant dès qu'un humain est détecté[cite: 35].
  • Niveau 2 (Confort & Notification - Analyse sémantique) : Home Assistant capture une image (snapshot) et l'envoie à un LLM multimodal (Gemini pour le cloud ou Qwen2-VL en local) pour générer une notification push riche décrivant la situation[cite: 35].