Inférence régionale

Les routes d'inférence régionales acheminent vos requêtes API vers des modèles hébergés dans une région géographique spécifique, garantissant que l'inférence s'effectue dans cette région et que les données traitées n'en sortent jamais. Si vous ne spécifiez pas de région, l'API utilise l'endpoint global de Mistral.

Groupes de régions

Groupes de régions

Utilisez un endpoint régional lorsque votre application doit traiter les requêtes dans une région géographique spécifique. Chaque groupe de régions correspond à une URL de base dédiée et peut inclure plusieurs data centers dans cette zone géographique.

Groupe de régionsURL de baseDisponibilitéGéographie
euapi.eu.mistral.aiDisponiblePlusieurs data centers dans les pays de l'UE et de l'AELE
usapi.us.mistral.aiBientôt disponiblePlusieurs data centers aux États-Unis
Comment utiliser un endpoint régional

Comment utiliser un endpoint régional

Version du SDK Python ≥ 2.70

Version du SDK Python ≥ 2.70

Utilisez le paramètre server lors de l'initialisation du client pour préciser la région :

import os
from mistralai.client import Mistral

client = Mistral(api_key=os.environ["MISTRAL_API_KEY"], server="eu")
response = client.chat.complete(
    model="mistral-medium-latest",
    messages=[{"role": "user", "content": "What is Mistral AI?"}],
)
print(response.choices[0].message.content)
Anciennes versions du SDK

Anciennes versions du SDK

Si vous utilisez une ancienne version du SDK, utilisez le paramètre server_url :

from mistralai.client import Mistral

client = Mistral(api_key=os.environ["MISTRAL_API_KEY"], server_url="https://api.eu.mistral.ai/")
list_models_response = client.models.list()
print(list_models_response)
Utiliser curl

Utiliser curl

curl https://api.eu.mistral.ai/v1/chat/completions \
  -H "Authorization: Bearer $MISTRAL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mistral-large-latest",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
Modèles disponibles

Modèles disponibles

Les endpoints régionaux ne servent que les modèles hébergés dans cette région. Utilisez models.list sur l'URL de base régionale pour voir quels modèles sont disponibles.

import os
from mistralai.client import Mistral

client = Mistral(api_key=os.environ["MISTRAL_API_KEY"], server="eu")
models = client.models.list()
for model in models.data:
    print(model.id)
Facturation

Facturation

L'inférence régionale est facturée à 1,1× la tarification standard (majoration de 10 %) pour les tokens d'entrée, les tokens de sortie, les lectures en cache et les écritures en cache.

Limitations

Limitations

  • Les appels d'outils ne sont pas pris en charge sur les endpoints régionaux.
  • Les fonctionnalités à état (Agents, Batch, API Files) ne sont pas disponibles sur les endpoints régionaux.
  • Les modèles disponibles varient selon la région.