Cloud
Inferenza per costruire la tua avanguardia in Europe.
Medium
from mistralai import Mistral
model = "mistral-medium-latest"
client = Mistral(api_key="")
chat_response = client.chat.complete(
model=model,
messages=[
{
"role": "user",
"content": "Explain a merkle tree in two sentences.",
},
],
)
print(chat_response.choices[0].message.content)from mistralai import Mistral
client = Mistral(api_key="")
agent = client.beta.agents.create(
model="mistral-medium-latest",
name="Websearch Agent",
description="Answers with up-to-date information from the web.",
tools=[{"type": "web_search"}],
)
print(agent.id)from mistralai import Mistral
with Mistral(
api_key='',
) as mistral:
ocr_response = mistral.ocr.process(
model='mistral-ocr-latest',
document={
'type': 'document_url',
'document_url': 'https://arxiv.org/pdf/2201.04234',
},
)
print(ocr_response.pages[0].markdown)from mistralai import Mistral
with Mistral(
api_key='',
) as mistral:
response = mistral.audio.transcriptions.complete(
model='voxtral-mini-latest',
)
print(response.text)from mistralai import Mistral
with Mistral(
api_key='',
) as mistral:
response = mistral.audio.speech.complete(
model='voxtral-mini-latest',
input='Today is going to be a great day.',
)
print(response)Sovranità dei dati per ogni richiesta.
Scegli tra i nostri modelli e le API
più potenti.
Mistral models
Mistral Medium 3.5
Prestazioni all'avanguardia. Distribuzioni aziendali semplificate. Efficiente in termini di costi.
Input (/M tokens)
$1.5
Output (/M tokens)
$7.5
OCR 4.1
New
The world’s best document extraction and understanding model.
OCR
$4
/ 1000 pages
Document AI
$5
/ 1000 pages

Voxtral Mini Transcribe 2
State-of-the-art batch audio transcription.
Audio Input/min
$0.003
Available on
/v1/audio/transcriptions
Enterprise APIs
API aziendali
Controlli regionali per l'elaborazione dei dati, SLA a livello di sistema, limiti di frequenza più elevati e supporto premium.
Esplora le risorse per sviluppatori.
Domande frequenti.
Sì, puoi chiamare i nostri endpoint di inferenza regionali nell'UE o, per i modelli supportati, negli Stati Uniti (api.eu.mistral.ai, api.us.mistral.ai) per elaborare le richieste per i modelli supportati nella regione preferita, ai fini della residenza dei dati o di una latenza ridotta, con un sovrapprezzo del 10%. In assenza di un endpoint regionale, le richieste utilizzano l'endpoint globale. Per il traffico di produzione, puoi richiedere Priority Tier, che dà priorità alle tue richieste rispetto al traffico standard, con il supporto di una SLA di disponibilità.
Serviamo noi stessi i modelli di terze parti, che vengono quindi eseguiti in sicurezza su un'infrastruttura GPU gestita da Mistral, senza modifiche e con gli stessi controlli regionali e impegni di servizio previsti per i nostri modelli. Le tue richieste vengono elaborate da Mistral. I modelli di terze parti seguono un programma di deprecazione più breve; consulta la politica sul ciclo di vita dei modelli.
I dati inviati tramite la nostra API non vengono utilizzati per l'addestramento dei modelli e la zero data retention è disponibile su richiesta.
Sì, in Studio puoi sperimentare i modelli generali con prompt nell'ambiente per agenti, oppure provare documenti e speech negli ambienti dedicati a OCR e audio.
Per le attività generali, la produttività e la codifica, Mistral Medium e GLM di Z.ai (ospitato da Mistral) sono i modelli più potenti. Per l'estrazione strutturata dai documenti — Mistral OCR, e Voxtral per trascrizione, clonazione vocale e agenti vocali. Per le attività operative che prevedono costi contenuti, Mistral Small e Ministral sono i modelli più leggeri. Confrontali nella panoramica dei modelli.
La maggior parte dei modelli ha un prezzo per milione di token, con input (i tuoi prompt) e output (le risposte) conteggiati separatamente. Ad esempio, Mistral Large costa $0,5 per milione di token in input e $1,5 per milione di token in output. L'elaborazione in batch, per le attività operative con volumi elevati, riduce il prezzo del 50% e i token di input memorizzati in cache riducono il costo dell'input fino al 90% per i prompt ripetuti. Alcune API hanno prezzi diversi: OCR si paga per 1.000 pagine, i modelli speech per minuto e le API per gli strumenti per chiamata.
Sì, i nostri modelli open-weight possono essere eseguiti ovunque — scaricali da Hugging Face e ospitali sul tuo hardware. Le licenze variano in base al modello, in genere Apache 2.0 oppure una versione modificata della licenza MIT, e possono cambiare. I clienti aziendali possono implementare i nostri modelli on-premises o nel proprio cloud, compresi hyperscaler come AWS, Azure e Google Cloud.


