> ## Documentation Index
> Fetch the complete documentation index at: https://phaseo.app/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Connecter des déploiements de modèles dédiés

> Ajoutez un endpoint privé compatible avec OpenAI au catalogue de modèles de votre espace de travail.

Les modèles privés permettent à votre équipe d’appeler un déploiement dédié ou auto-hébergé via l’API Phaseo habituelle. Le modèle apparaît uniquement aux membres authentifiés de l’espace de travail et peut être utilisé partout où vous utiliseriez un identifiant de modèle public.

Les sources courantes incluent des déploiements dédiés sur Baseten, Modal, RunPod, Fireworks ou Together, ainsi que des services exécutant vLLM ou un autre serveur compatible avec OpenAI.

## Avant de commencer

Votre déploiement doit fournir :

* une URL de base HTTPS publique ;
* un endpoint `/chat/completions` compatible avec OpenAI ;
* une authentification par jeton Bearer ; et
* un identifiant de modèle ou de déploiement du fournisseur accepté par cet endpoint.

La prise en charge de `/responses` est facultative. Laissez-la désactivée sauf si le déploiement implémente explicitement cet endpoint.

<Warning>
  Les modèles privés n’adaptent pas les protocoles propres aux fournisseurs ni les schémas d’authentification personnalisés. Placez une couche compatible avec OpenAI devant ces déploiements ou utilisez une intégration de fournisseur prise en charge par Phaseo.
</Warning>

## Connecter un déploiement

<Steps>
  <Step title="Ouvrir les modèles privés">
    Ouvrez **Tableau de bord → Paramètres → Espace de travail → Modèles privés**, puis sélectionnez **Ajouter un modèle**. Vous devez être propriétaire ou administrateur de l’espace de travail.
  </Step>

  <Step title="Nommer le modèle">
    Choisissez un modèle existant du catalogue pour ajouter ce déploiement à sa liste de fournisseurs, ou saisissez un identifiant court tel que `legal-assistant`. Si aucun modèle du catalogue ne possède cet identifiant unique, Phaseo le combine avec l’espace de noms de confiance de l’espace de travail :

    ```text theme={null}
    acme/legal-assistant
    ```

    Vous ne pouvez pas choisir ni remplacer l’espace de noms de l’espace de travail. Les identifiants exacts du catalogue se rattachent à ce modèle sans modifier son identité publique.
  </Step>

  <Step title="Configurer l’endpoint">
    Saisissez l’URL de base sans le chemin d’inférence. Par exemple :

    ```text theme={null}
    https://model.example.com/v1
    ```

    N’incluez pas `/chat/completions` ni `/responses`. Saisissez séparément l’identifiant exact du modèle ou du déploiement du fournisseur ; Phaseo le substitue lors du transfert des requêtes.
  </Step>

  <Step title="Enregistrer l’identifiant">
    Saisissez la clé API du déploiement. Phaseo chiffre cet identifiant et ne le renvoie jamais après l’enregistrement. Vous pouvez le remplacer ultérieurement dans les paramètres du modèle.
  </Step>

  <Step title="Appeler le modèle">
    Utilisez l’identifiant de modèle généré avec l’endpoint Chat Completions habituel :

    ```bash cURL theme={null}
    curl https://api.phaseo.app/v1/chat/completions \
      -H "Authorization: Bearer $PHASEO_API_KEY" \
      -H "Content-Type: application/json" \
      -d '{
        "model": "acme/legal-assistant",
        "messages": [{"role": "user", "content": "Summarize this contract."}]
      }'
    ```

    La clé API utilisée doit appartenir au même espace de travail que le modèle privé.
  </Step>
</Steps>

## Fonctionnement du routage

Les modèles privés utilisent la même interface de requête Phaseo que les modèles du catalogue. Un modèle autonome d’espace de travail est routé uniquement vers son endpoint configuré. Un endpoint rattaché à un modèle du catalogue rejoint sa liste de fournisseurs selon la politique **Préféré**, **Groupe normal** ou **Secours uniquement**. Phaseo envoie l’identifiant enregistré comme jeton Bearer et substitue l’identifiant de modèle du fournisseur configuré.

Un modèle privé ne devient pas une route publique de fournisseur et n’est pas visible dans les autres espaces de travail. Les modèles privés activés sont inclus dans le catalogue authentifié et apparaissent sous le filtre **Privés**.

<Note>
  Après avoir ajouté ou activé un déploiement privé sur un modèle existant du catalogue, attendez 5 à 10 secondes pour que le changement se propage dans la couche API avant de tester son routage. Pendant ce délai, les requêtes peuvent continuer à utiliser les fournisseurs publics existants du modèle. Les requêtes déjà en cours ne sont pas reroutées.
</Note>

## Exemples de fournisseurs

| Déploiement | Valeurs à saisir |
| - | - |
| Endpoint dédié Baseten | Son URL de base compatible avec OpenAI, l’identifiant du modèle déployé et la clé API |
| Endpoint web Modal | Un endpoint HTTPS public implémentant le contrat OpenAI Chat Completions |
| Endpoint sans serveur RunPod | Une URL de proxy compatible avec OpenAI et un identifiant Bearer |
| Déploiement dédié Fireworks ou Together | L’URL dédiée compatible avec OpenAI et l’identifiant du modèle du fournisseur |
| vLLM | L’URL publique se terminant par `/v1` et le nom du modèle servi par vLLM |

Les produits des fournisseurs et les formats d’URL peuvent changer. Vérifiez l’URL de base, l’identifiant du modèle, la méthode d’authentification et les endpoints pris en charge dans la documentation de déploiement actuelle du fournisseur.

## Gérer les modèles privés via l’API

L’administration côté serveur peut utiliser l’[API des modèles privés](../api-reference/endpoint/private-models-list) avec une clé de gestion disposant de `private_models:read`, `private_models:write` ou `private_models:delete`, selon les besoins.

Les requêtes de création et de mise à jour acceptent `model_reference`, soit un identifiant exact du catalogue, soit un identifiant court. Phaseo déduit `model_id` ; les clients ne peuvent pas le transmettre directement. Utilisez `host_provider_id` pour un fournisseur Phaseo existant, ou `custom_provider_name` et éventuellement `custom_provider_url` pour un autre opérateur.

## Dépannage

* **404 du fournisseur :** Vérifiez que l’URL de base s’arrête avant le chemin d’inférence.
* **Modèle inconnu :** Copiez l’identifiant de déploiement du fournisseur dans **Identifiant du modèle du fournisseur**. N’utilisez pas l’identifiant de modèle de l’espace de travail Phaseo à cet endroit.
* **Requête non autorisée chez le fournisseur :** Remplacez l’identifiant enregistré et confirmez que le fournisseur accepte l’authentification Bearer.
* **Chat fonctionne mais Responses échoue :** Désactivez **Responses API** sauf si le fournisseur implémente `/responses` nativement.
* **Modèle absent du catalogue :** Confirmez que le modèle est activé et que l’appelant est authentifié dans le même espace de travail.


This documentation is built and hosted on [Mintlify](https://mintlify.com), a developer documentation platform.