Skip to main content
Les modèles privés permettent à votre équipe d’appeler un déploiement dédié ou auto-hébergé via l’API Phaseo habituelle. Le modèle apparaît uniquement aux membres authentifiés de l’espace de travail et peut être utilisé partout où vous utiliseriez un identifiant de modèle public. Les sources courantes incluent des déploiements dédiés sur Baseten, Modal, RunPod, Fireworks ou Together, ainsi que des services exécutant vLLM ou un autre serveur compatible avec OpenAI.

Avant de commencer

Votre déploiement doit fournir :
  • une URL de base HTTPS publique ;
  • un endpoint /chat/completions compatible avec OpenAI ;
  • une authentification par jeton Bearer ; et
  • un identifiant de modèle ou de déploiement du fournisseur accepté par cet endpoint.
La prise en charge de /responses est facultative. Laissez-la désactivée sauf si le déploiement implémente explicitement cet endpoint.
Les modèles privés n’adaptent pas les protocoles propres aux fournisseurs ni les schémas d’authentification personnalisés. Placez une couche compatible avec OpenAI devant ces déploiements ou utilisez une intégration de fournisseur prise en charge par Phaseo.

Connecter un déploiement

1

Ouvrir les modèles privés

Ouvrez Tableau de bord → Paramètres → Espace de travail → Modèles privés, puis sélectionnez Ajouter un modèle. Vous devez être propriétaire ou administrateur de l’espace de travail.
2

Nommer le modèle

Choisissez un modèle existant du catalogue pour ajouter ce déploiement à sa liste de fournisseurs, ou saisissez un identifiant court tel que legal-assistant. Si aucun modèle du catalogue ne possède cet identifiant unique, Phaseo le combine avec l’espace de noms de confiance de l’espace de travail :
Vous ne pouvez pas choisir ni remplacer l’espace de noms de l’espace de travail. Les identifiants exacts du catalogue se rattachent à ce modèle sans modifier son identité publique.
3

Configurer l’endpoint

Saisissez l’URL de base sans le chemin d’inférence. Par exemple :
N’incluez pas /chat/completions ni /responses. Saisissez séparément l’identifiant exact du modèle ou du déploiement du fournisseur ; Phaseo le substitue lors du transfert des requêtes.
4

Enregistrer l’identifiant

Saisissez la clé API du déploiement. Phaseo chiffre cet identifiant et ne le renvoie jamais après l’enregistrement. Vous pouvez le remplacer ultérieurement dans les paramètres du modèle.
5

Appeler le modèle

Utilisez l’identifiant de modèle généré avec l’endpoint Chat Completions habituel :
cURL
La clé API utilisée doit appartenir au même espace de travail que le modèle privé.

Fonctionnement du routage

Les modèles privés utilisent la même interface de requête Phaseo que les modèles du catalogue. Un modèle autonome d’espace de travail est routé uniquement vers son endpoint configuré. Un endpoint rattaché à un modèle du catalogue rejoint sa liste de fournisseurs selon la politique Préféré, Groupe normal ou Secours uniquement. Phaseo envoie l’identifiant enregistré comme jeton Bearer et substitue l’identifiant de modèle du fournisseur configuré. Un modèle privé ne devient pas une route publique de fournisseur et n’est pas visible dans les autres espaces de travail. Les modèles privés activés sont inclus dans le catalogue authentifié et apparaissent sous le filtre Privés.
Après avoir ajouté ou activé un déploiement privé sur un modèle existant du catalogue, attendez 5 à 10 secondes pour que le changement se propage dans la couche API avant de tester son routage. Pendant ce délai, les requêtes peuvent continuer à utiliser les fournisseurs publics existants du modèle. Les requêtes déjà en cours ne sont pas reroutées.

Exemples de fournisseurs

Les produits des fournisseurs et les formats d’URL peuvent changer. Vérifiez l’URL de base, l’identifiant du modèle, la méthode d’authentification et les endpoints pris en charge dans la documentation de déploiement actuelle du fournisseur.

Gérer les modèles privés via l’API

L’administration côté serveur peut utiliser l’API des modèles privés avec une clé de gestion disposant de private_models:read, private_models:write ou private_models:delete, selon les besoins. Les requêtes de création et de mise à jour acceptent model_reference, soit un identifiant exact du catalogue, soit un identifiant court. Phaseo déduit model_id ; les clients ne peuvent pas le transmettre directement. Utilisez host_provider_id pour un fournisseur Phaseo existant, ou custom_provider_name et éventuellement custom_provider_url pour un autre opérateur.

Dépannage

  • 404 du fournisseur : Vérifiez que l’URL de base s’arrête avant le chemin d’inférence.
  • Modèle inconnu : Copiez l’identifiant de déploiement du fournisseur dans Identifiant du modèle du fournisseur. N’utilisez pas l’identifiant de modèle de l’espace de travail Phaseo à cet endroit.
  • Requête non autorisée chez le fournisseur : Remplacez l’identifiant enregistré et confirmez que le fournisseur accepte l’authentification Bearer.
  • Chat fonctionne mais Responses échoue : Désactivez Responses API sauf si le fournisseur implémente /responses nativement.
  • Modèle absent du catalogue : Confirmez que le modèle est activé et que l’appelant est authentifié dans le même espace de travail.
Dernière modification le 2 octobre 2026