33800 Docs

← Retour

État des lieux IA - Orchestrator & Jobs

Date : 19/01/2026 00:10 (MAJ) Auteur : Claude Status : COMPLET - Applio et SadTalker réinstallés


Résumé

Inventaire complet des 10 outils IA gérés par l'orchestrator avec leur mode d'exécution et status.


1. Outils IA - État actuel

Outil Catégorie Port Mode Status Job Notes
ollama LLM 11434 Full API ✅ Testé REST API native
comfyui Image 8188 Full API ✅ SUCCESS SDXL workflow
fooocus Image 7865 Full API ✅ Testé REST API
bark Audio TTS 7866 Full API ✅ Testé Gradio API
musicgen Audio Music 7867 Full API ✅ Testé Gradio API
facefusion Face 7869 Full API ⚠️ File issue Gradio 5.x API
wan21 Video 7860 CLI mode ✅ FIXÉ Bypass Gradio
applio Audio RVC 6969 Full API ✅ TESTÉ Gradio 5.x, 60 params
sadtalker Face 7868 CLI mode ✅ TESTÉ NumPy patches + modèles
triposr 3D 7870 Full API ✅ FIXÉ PyMCubes patch

2. Analyse détaillée par catégorie

LLM (ollama)

Image (comfyui, fooocus)

Audio (bark, musicgen, applio)

Video (wan21)

Face (sadtalker, facefusion)

3D (triposr)


3. Historique Jobs récents

Job Tool Status Durée Notes
triposr 3d ✅ SUCCESS ~30s Queue test - 1.6 Mo GLB
bark audio tts ✅ SUCCESS ~90s Queue test - 540 Ko WAV
ollama llm ✅ SUCCESS ~5s Queue test - list_models (16)
sadtalker face ✅ SUCCESS 278s CLI mode - talking head
applio audio rvc ✅ SUCCESS ~5s Voice conversion Haruka
wan21 video ✅ SUCCESS 219s CLI mode - sunset ocean
triposr 3d ✅ SUCCESS 18s PyMCubes patch
comfyui image ✅ SUCCESS 177s SDXL workflow
fooocus image ✅ SUCCESS 25s Phoenix flames
bark audio ✅ SUCCESS 24s TTS français
musicgen audio ✅ SUCCESS 151s EDM track

4. Corrections effectuées (18/01/2026)

Wan2.1 - Mode CLI (17:35)

Problème : Crash systématique en Full API Gradio

Solution :

  1. Mode CLI : Utilise generate.py directement via SSH
  2. Patch attention : I:\Wan2.1\wan\modules\model.py
    # Avant
    from .attention import flash_attention
    # Après
    from .attention import attention as flash_attention
  3. Wrapper base64 : Script Python temporaire avec prompt encodé
  4. SFTP : Format /I:/path au lieu de SCP

Commits GitLab :

TripoSR - Patch PyMCubes (16:45)

Problème : torchmcubes nécessite compilation CUDA

Solution :


5. Actions restantes

Priorité HAUTE (fixé ✅)

  1. Investiguer Wan2.1 → ✅ FIXÉ avec CLI mode
  2. Tester TripoSR Full API → ✅ FIXÉ avec PyMCubes

Priorité MOYENNE (fixé ✅)

  1. Tester Applio Full API → ✅ TESTÉ avec modèle Haruka
  2. Réécrire executor Applio → ✅ Gradio 5 API (60 params)
  3. Réécrire executor SadTalker → ✅ CLI mode

Priorité BASSE (fixé ✅)

  1. Tester SadTalker Full API → ✅ CLI mode (Gradio API bug)
  2. Tester Queue System complet → ✅ Ollama, Bark, TripoSR testés

Documentation

  1. Documenter usage FaceFusion - Chemin des fichiers input (/ai-data/inputs/)

6. Queue System Status

Pending High:   0
Pending Normal: 0
Pending Low:    0
Current Tool:   triposr (dernier utilisé)

Tests Queue System (21:25):

Le système de queue fonctionne correctement avec switch automatique d'outils.


7. Fichiers modifiés sur win11

Outils sur I:\ (anciens)

Fichier Modification
I:\Wan2.1\wan\modules\model.py Import attention avec fallback
I:\TripoSR\tsr\models\isosurface.py Utilise mcubes au lieu de torchmcubes

Outils sur C:\Users\gouro\ (nouveaux - 19/01/2026)

Fichier Modification
C:\Users\gouro\SadTalker\src\face3d\util\my_awing_arch.py np.float → float
C:\Users\gouro\SadTalker\src\face3d\util\preprocess.py float(t[0]), float(t[1]), float(s)
C:\Users\gouro\SadTalker\venv\Lib\site-packages\basicsr\data\degradations.py from torchvision.transforms.functional import rgb_to_grayscale

Note : Ces patches doivent être préservés lors de mises à jour des outils.

Backups : /stock_8to/backups/win11-patches/


8. Migration Applio/SadTalker (19/01/2026)

Nouveaux chemins

Outil Ancien chemin Nouveau chemin
Applio I:\Applio (non installé) C:\Users\gouro\Applio
SadTalker I:\SadTalker (non installé) C:\Users\gouro\SadTalker

Installation effectuée

Patches requis pour SadTalker

  1. basicsr: Fix import torchvision pour versions récentes
  2. my_awing_arch.py: np.float déprécié
  3. preprocess.py: Extraction scalaires NumPy

Test CLI direct

cd C:\Users\gouro\SadTalker
venv\Scripts\python.exe inference.py --source_image inputs/happy.png --driven_audio inputs/RD_Radio31_000.wav --result_dir results/test --checkpoint_dir checkpoints

Résultat : ✅ 175 Ko MP4 en ~30s