Cloud
L'inférence pour construire votre IA de pointe en Europe.
Medium
from mistralai import Mistral
model = "mistral-medium-latest"
client = Mistral(api_key="")
chat_response = client.chat.complete(
model=model,
messages=[
{
"role": "user",
"content": "Explain a merkle tree in two sentences.",
},
],
)
print(chat_response.choices[0].message.content)from mistralai import Mistral
client = Mistral(api_key="")
agent = client.beta.agents.create(
model="mistral-medium-latest",
name="Websearch Agent",
description="Answers with up-to-date information from the web.",
tools=[{"type": "web_search"}],
)
print(agent.id)from mistralai import Mistral
with Mistral(
api_key='',
) as mistral:
ocr_response = mistral.ocr.process(
model='mistral-ocr-latest',
document={
'type': 'document_url',
'document_url': 'https://arxiv.org/pdf/2201.04234',
},
)
print(ocr_response.pages[0].markdown)from mistralai import Mistral
with Mistral(
api_key='',
) as mistral:
response = mistral.audio.transcriptions.complete(
model='voxtral-mini-latest',
)
print(response.text)from mistralai import Mistral
with Mistral(
api_key='',
) as mistral:
response = mistral.audio.speech.complete(
model='voxtral-mini-latest',
input='Today is going to be a great day.',
)
print(response)La souveraineté des données pour chaque requête.
Choisissez parmi nos
modèles et API les plus puissants.
Mistral models
Mistral Medium 3.5
Performances de pointe. Déploiements simplifiés en entreprises. Tout en restant économique.
Input (/M tokens)
$1.5
Output (/M tokens)
$7.5
OCR 4.1
New
The world’s best document extraction and understanding model.
OCR
$4
/ 1000 pages
Document AI
$5
/ 1000 pages

Voxtral Mini Transcribe 2
State-of-the-art batch audio transcription.
Audio Input/min
$0.003
Available on
/v1/audio/transcriptions
Enterprise APIs
API Entreprise
Contrôles régionaux du traitement des données, SLA au niveau système, limites de débit accrues et assistance premium.
Explorez les ressources pour les développeurs.
Foire aux questions.
Oui, vous pouvez appeler nos endpoints d'inférence régionaux dans l'UE ou, pour les modèles pris en charge, aux États-Unis (api.eu.mistral.ai, api.us.mistral.ai) afin de traiter vos requêtes dans la région de votre choix, pour la résidence des données ou une latence réduite, moyennant un supplément de 10 %. Sans endpoint régional, les requêtes passent par l'endpoint global. Pour le trafic de production, vous pouvez demander le Priority Tier, qui donne la priorité à vos requêtes sur le trafic standard, avec un SLA de disponibilité.
Nous hébergeons nous-mêmes les modèles tiers, qui s'exécutent donc en toute sécurité sur l'infrastructure GPU gérée par Mistral, sans modifications et avec les mêmes contrôles régionaux et engagements de service que nos propres modèles. Vos requêtes sont traitées par Mistral. Les modèles tiers suivent un calendrier de dépréciation plus court ; consultez la politique de cycle de vie des modèles.
Les données envoyées via notre API ne sont pas utilisées pour l'entraînement des modèles, et une rétention nulle des données est disponible sur demande.
Oui, dans Studio, vous pouvez tester les modèles généralistes avec des prompts dans le playground d'agents, ou essayer documents et parole dans les playgrounds OCR et audio dédiés.
Pour les tâches générales, la productivité et le codage, Mistral Medium et GLM de Z.ai (hébergé par Mistral) sont les modèles les plus performants. Pour l'extraction structurée de documents : Mistral OCR, et Voxtral pour la transcription, le clonage de la voix et les agents vocaux. Pour les travaux sensibles aux coûts, Mistral Small et Ministral sont les modèles les plus légers. Comparez-les dans la vue d'ensemble des modèles.
La plupart des modèles sont facturés au million de tokens, avec une comptabilisation distincte de l'entrée (vos prompts) et de la sortie (les réponses). Par exemple, Mistral Large coûte 0,5 $ par million de tokens en entrée et 1,5 $ par million de tokens en sortie. Le traitement par batch, pour les volumes importants, réduit le prix de 50 %, et les tokens d'entrée mis en cache réduisent jusqu'à 90 % le coût des entrées pour les prompts répétés. Quelques API sont facturées différemment : l'OCR par tranche de 1 000 pages, les modèles de parole à la minute, et les API d'outils à l'appel.
Oui, nos modèles à poids ouverts peuvent s'exécuter n'importe où : téléchargez-les depuis Hugging Face et hébergez-les sur votre propre matériel. Les licences varient selon le modèle, généralement Apache 2.0 ou une version modifiée de la licence MIT, et peuvent évoluer. Les clients Entreprise peuvent déployer nos modèles sur site ou dans leur propre cloud, y compris chez des hyperscalers comme AWS, Azure et Google Cloud.


