Configuration d'une API compatible OpenAI dans Tavern Studio
La configuration d'une API compatible OpenAI requiert généralement trois éléments : une URL de base (base URL), une clé API (ou un jeton d'authentification si requis) et un identifiant de modèle. Tavern Studio conserve cette configuration de fournisseur séparée des cartes de personnage et des presets afin que vous puissiez changer de route de modèle sans réécrire vos personnages.
De nombreux fournisseurs et serveurs locaux exposent des API de type /chat/completions inspirées d'OpenAI. Certains ne le font pas, c'est pourquoi nous vous conseillons de toujours vérifier la documentation de votre fournisseur.
À qui cela s'adresse
- Aux utilisateurs connectant des services cloud via une API compatible OpenAI.
- Aux développeurs utilisant des serveurs d'application LLM locale.
- Aux personnes disposant de passerelles personnalisées ou de proxys inverses.
- Aux utilisateurs de SillyTavern migrant leurs paramètres d'API.
Concepts clés
Un point de terminaison compatible OpenAI s'appuie généralement sur une authentification par jeton porteur (bearer token) et sur un corps de requête de chat completions contenant le modèle (model) et les messages (messages). Les serveurs locaux peuvent se passer de clé API. Les passerelles personnalisées peuvent quant à elles ajouter leurs propres en-têtes (headers), identifiants de compte ou chemins d'accès.
Ne stockez pas les détails du fournisseur à l'intérieur des cartes de personnage. Veillez à ce que les personnages, les presets et les routes de modèles restent bien séparés.
La solution Tavern Studio
Tavern Studio prend en charge la configuration d'une API compatible OpenAI et peut mapper les services les plus courants lors d'une migration depuis SillyTavern. Les points de terminaison personnalisés, les services locaux, les proxys inverses, Azure OpenAI, Cloudflare Workers AI, les URL de base manquantes et les modèles par défaut non configurés peuvent nécessiter une intervention manuelle.
Le système d'assemblage de prompt de l'application prépare des structures de tableaux de messages adaptées aux routes de type OpenAI.
Étapes d'utilisation
- Ouvrez les paramètres d'API ou de connexion des modèles.
- Choisissez une route basée sur une API compatible OpenAI.
- Saisissez l'URL de base.
- Saisissez la clé API si le point de terminaison en requiert une.
- Saisissez ou sélectionnez l'identifiant du modèle.
- Enregistrez la connexion.
- Envoyez un court message de test.
- Associez la route au chat ou au flux de travail de preset souhaité.
FAQ
Qu'est-ce qu'une API compatible OpenAI ?
C'est un point de terminaison qui suit les structures de requête et de réponse d'OpenAI, en incluant généralement le chemin /chat/completions.
Puis-je utiliser un serveur local ?
Oui, à condition que le serveur expose une API compatible et que l'URL de base ainsi que les paramètres de modèle soient correctement configurés.
Tavern Studio contourne-t-il les clés API des fournisseurs ?
Non. Vous devez utiliser des identifiants valides fournis par le fournisseur ou par votre propre service d'application LLM locale.
Pourquoi ma connexion au point de terminaison échoue-t-elle ?
Les causes fréquentes sont une mauvaise URL de base, l'absence du suffixe /v1, un identifiant de modèle incorrect, une clé API invalide, des problèmes de proxy ou des différences de protocole spécifiques au fournisseur.
Un même personnage peut-il utiliser plusieurs points de terminaison ?
Oui. Le même personnage peut être testé avec différentes routes en modifiant simplement les paramètres de chat, de modèle et les presets associés.
Étapes suivantes
- Comparez avec le routage cloud dans le Client de chat API cloud.
- Découvrez les alternatives locales avec le guide pour Exécuter des LLM locaux sous Windows.
- Ajustez le comportement de génération dans le Gestionnaire de presets et de prompts.