Donner à aimee et claudia, nos deux MacBook Pro headless, l'accès à tous les modèles pour lancer des workflows : fusion, délégation, loops, objectifs.
2026-07-22 · carte des modèles validée ce jour · Maia
Chaque modèle vit dans son coin. Des CLI en OAuth forfaitaire d'un côté (claude, codex, kimi, grok, agy), des modèles à clé API de l'autre (GLM, DeepSeek, MiniMax). Il n'existe pas de point unique d'où lancer un workflow qui en combine plusieurs.
Un hub, c'est un point d'accès unique aux modèles. Pas un bloc monolithique pour autant : deux voies se complètent.
claude, codex, kimi, grok, agy tiennent une session interactive en OAuth forfaitaire. Ils passent mal derrière un proxy, donc on ne les déplace pas.
Un routeur regroupe seulement les modèles à clé API : GLM-5.2 via Proxima, DeepSeek, MiniMax. Une seule porte, un seul format d'appel, une bascule de quota possible.
Les grandes lignes (les CLI) gardent leurs quais dédiés. Les navettes locales (les modèles à clé) passent toutes par le même hall d'aiguillage, LiteLLM.
Un provider par carte, avec son mode d'accès. Cliquez une carte pour déplier ses modèles.
Chaque modèle : sa voie d'accès (CLI en OAuth ou clé API via LiteLLM), son coût réel, son statut.
Cinq axes. Cliquez une légende pour isoler un modèle. Notes indicatives, à confirmer par test.
Les deux nodes appellent le hub. Le hub aiguille vers les CLI directs ou vers LiteLLM. Maia juge, elle n'exécute jamais.
Le hub existe pour ça : enchaîner les modèles au lieu de les appeler un par un.
On règle les trois points ouverts, on branche le routeur LiteLLM, puis on ouvre l'accès du hub aux deux nodes. Les workflows suivent.
Données live, dernière mise à jour : 2026-07-22 21:54. Rafraîchis (Ctrl+F5) pour l'état le plus récent.
Hub LLM · build 2026-07-22 · diffusion interne Zetamind