Aller au contenu

Documentation officielle

Reprenez le contrôle sur vos usages de l'IA générative

Xolo se place entre vos applications et les fournisseurs de modèles. Il tient les clés d'API, les budgets et le routage entre modèles, et garde une trace de chaque requête. Un binaire, sous licence AGPL-3.0.

Installer Xolo Comprendre le modèle

CLIENTS LLM FOURNISSEURS Chat SDK OpenAI Agents outils, RAG IDE / CLI clé d'application API distante OpenAI, Azure… API européenne Mistral, OVH… Auto-hébergement Ollama, vLLM, autre… Xolo 1 · AUTHENTIFIER Clé d'application rôle et permissions 2 · CONTRÔLER Budget et quota organisation, membre 3 · ROUTER Modèle virtuel pipeline : plugins, modèles repli et pondération Un événement par requête coût · latence · énergie

Par où commencer

Trois parcours, selon votre rôle

En cinq minutes

Une instance locale, une clé, un premier appel.

$ docker run -p 8080:8080 \
    ghcr.io/xolo-gateway/xolo:latest

# puis, une fois l'organisation créée
$ curl localhost:8080/v1/chat/completions \
    -H "Authorization: Bearer $XOLO_KEY" \
    -d '{"model":"gpt-4o-mini","messages":[…]}'
$ git clone https://github.com/xolo-gateway/xolo
$ cd xolo && make run

# l'interface écoute sur http://localhost:8080