• Cloud

Inferenza per costruire la tua avanguardia in Europe.

Accedi ai modelli all'avanguardia e implementali tramite un'unica API, con la potenza di Mistral Cloud.

Ottieni la chiave API

Medium

Read our docs

from mistralai import Mistral

model = "mistral-medium-latest"

client = Mistral(api_key="")

chat_response = client.chat.complete(
    model=model,
    messages=[
        {
            "role": "user",
            "content": "Explain a merkle tree in two sentences.",
        },
    ],
)

print(chat_response.choices[0].message.content)

Add your API key

Create a key in Mistral Studio, then paste it below to complete the snippet.

Open Studio
Snowflake (black)
Harvey (black)
MongoDB (black)

Sovranità dei dati per ogni richiesta.

Scegli dove avviene l'elaborazione.

Elabora le richieste nell'UE o, per i modelli supportati, negli Stati Uniti per la residenza dei dati e una latenza ridotta. Ogni regione è un'implementazione completamente indipendente, con capacità dedicata e un proprio perimetro dei dati.

Sappi chi gestisce i dati.

Ogni modello è servito direttamente da Mistral, quindi i modelli aperti di terze parti vengono eseguiti in sicurezza, con gli stessi controlli regionali e impegni di servizio previsti per i nostri modelli.

Limita ciò che viene conservato.

Attiva l'opzione zero data retention oppure passa a un'implementazione privata per i requisiti normativi più stringenti.

Utilizziamo i modelli Mistral Small in Firefox per portare a milioni di utenti un'AI veloce, accurata e multilingue nel browser.

Alexander Osipenko, Staff Machine Learning Engineer, Firefox.

"Mistral ci consente di eseguire modelli aperti nel rispetto di rigorosi controlli regionali e di impegni di servizio, semplificando la gestione della residenza dei dati e dei requisiti di conformità e rafforzando al tempo stesso il nostro impegno verso l'open source."

Matan Grinberg, CEO e co-fondatore, Factory.

Scegli tra i nostri modelli e le API
più potenti.

Mistral models

Mistral Medium 3.5

Prestazioni all'avanguardia. Distribuzioni aziendali semplificate. Efficiente in termini di costi.

Input (/M tokens)

$1.5

Output (/M tokens)

$7.5

OCR 4.1

New

The world’s best document extraction and understanding model.

OCR

$4

/ 1000 pages

Document AI

$5

/ 1000 pages

Voxtral Mini Transcribe 2

State-of-the-art batch audio transcription.

Audio Input/min

$0.003

Available on

/v1/audio/transcriptions

Third party models

GLM 5.3

New

Third-party model specializing in long-context agentic workflows and coding.

Input (/M tokens)

$1.4

Output (/M tokens)

$4.4

Esplora

Visualizza i modelli fianco a fianco per trovare quello più adatto al tuo caso d'uso.

Confronta

Enterprise APIs

API aziendali

Controlli regionali per l'elaborazione dei dati, SLA a livello di sistema, limiti di frequenza più elevati e supporto premium.

Contattaci

Esplora le risorse per sviluppatori.

Riferimento API

Il riferimento REST completo, con schemi ed esempi.

SDK

Client ufficiali di Mistral per Python e TypeScript.

Guide

Esempi funzionanti per agenti, retrieval, OCR e altro ancora.

Unisciti alla nostra Community

Richiedi assistenza e condividi ciò che crei.

Domande frequenti.

Sì, puoi chiamare i nostri endpoint di inferenza regionali nell'UE o, per i modelli supportati, negli Stati Uniti (api.eu.mistral.ai, api.us.mistral.ai) per elaborare le richieste per i modelli supportati nella regione preferita, ai fini della residenza dei dati o di una latenza ridotta, con un sovrapprezzo del 10%. In assenza di un endpoint regionale, le richieste utilizzano l'endpoint globale. Per il traffico di produzione, puoi richiedere Priority Tier, che dà priorità alle tue richieste rispetto al traffico standard, con il supporto di una SLA di disponibilità.

Serviamo noi stessi i modelli di terze parti, che vengono quindi eseguiti in sicurezza su un'infrastruttura GPU gestita da Mistral, senza modifiche e con gli stessi controlli regionali e impegni di servizio previsti per i nostri modelli. Le tue richieste vengono elaborate da Mistral. I modelli di terze parti seguono un programma di deprecazione più breve; consulta la politica sul ciclo di vita dei modelli.

I dati inviati tramite la nostra API non vengono utilizzati per l'addestramento dei modelli e la zero data retention è disponibile su richiesta.

Sì, in Studio puoi sperimentare i modelli generali con prompt nell'ambiente per agenti, oppure provare documenti e speech negli ambienti dedicati a OCR e audio.

Per le attività generali, la produttività e la codifica, Mistral Medium e GLM di Z.ai (ospitato da Mistral) sono i modelli più potenti. Per l'estrazione strutturata dai documenti — Mistral OCR, e Voxtral per trascrizione, clonazione vocale e agenti vocali. Per le attività operative che prevedono costi contenuti, Mistral Small e Ministral sono i modelli più leggeri. Confrontali nella panoramica dei modelli.

La maggior parte dei modelli ha un prezzo per milione di token, con input (i tuoi prompt) e output (le risposte) conteggiati separatamente. Ad esempio, Mistral Large costa $0,5 per milione di token in input e $1,5 per milione di token in output. L'elaborazione in batch, per le attività operative con volumi elevati, riduce il prezzo del 50% e i token di input memorizzati in cache riducono il costo dell'input fino al 90% per i prompt ripetuti. Alcune API hanno prezzi diversi: OCR si paga per 1.000 pagine, i modelli speech per minuto e le API per gli strumenti per chiamata.

Sì, i nostri modelli open-weight possono essere eseguiti ovunque — scaricali da Hugging Face e ospitali sul tuo hardware. Le licenze variano in base al modello, in genere Apache 2.0 oppure una versione modificata della licenza MIT, e possono cambiare. I clienti aziendali possono implementare i nostri modelli on-premises o nel proprio cloud, compresi hyperscaler come AWS, Azure e Google Cloud.

Inizia a creare

Prototipa → Rilascia → Scala
con Mistral.

gradient background
cat sitting