siati.ai docs

Catalogo

Catalogo dei modelli

Cosa possiamo servirvi: quello già caricato e quello che accendiamo su richiesta.

Pronti all'uso

Già caricati: la prima richiesta risponde senza attesa di avvio. Sono 7.

Apertus 70B

apertus-70b-instruct

risposta immediata

Il modello svizzero della Swiss AI Initiative — EPFL, ETH di Zurigo e Centro svizzero di calcolo scientifico. Parla italiano, tedesco, francese, inglese e romancio. È la scelta predefinita per la conversazione e per le risposte sui vostri documenti.

CHF 1.00 in entrata · CHF 3.00 in uscita, per milione di token

Gemma 4 26B

gemma-4-26b

immagini risposta immediata

Legge anche le immagini, non solo il testo: utile per fotografie di documenti, scansioni e schermate. Buono nel restituire dati strutturati da un testo libero, quindi nell’estrarre campi da un contratto o da una fattura.

CHF 0.30 in entrata · CHF 0.60 in uscita, per milione di token

Qwen 2.5 32B

qwen2.5:32b

risposta immediata

Il più capace fra i modelli di taglia media: adatto quando la domanda richiede di ragionare su più passaggi, non solo di riformulare. Consigliato per analisi e sintesi di documenti complessi.

CHF 0.30 in entrata · CHF 0.90 in uscita, per milione di token

Qwen 2.5 14B

qwen2.5:14b

risposta immediata

Buon compromesso fra qualità e rapidità. La scelta giusta per il volume: classificazione, riassunti, prime bozze, risposte a domande frequenti.

CHF 0.15 in entrata · CHF 0.45 in uscita, per milione di token

Qwen 2.5 1.5B

qwen2.5:1.5b

risposta immediata

Modello leggero e molto rapido, per compiti semplici e ripetitivi dove conta il tempo di risposta più della sfumatura.

CHF 0.05 in entrata · CHF 0.10 in uscita, per milione di token

BGE-M3 (Embeddings)

bge-m3

risposta immediata

Trasforma un testo in una rappresentazione numerica che permette di cercare per significato invece che per parole esatte. È il motore della ricerca sui vostri documenti. Funziona su testi in lingue diverse, anche mescolate.

CHF 0.12 in entrata · CHF 0.00 in uscita, per milione di token

BGE Reranker v2 m3

bge-reranker-v2-m3

risposta immediata

Seconda passata sui risultati di una ricerca: rilegge i candidati insieme alla domanda e li riordina per pertinenza reale. Serve a far arrivare in cima la risposta giusta, non solo quella che somiglia di più alle parole cercate.

CHF 2.50 ogni 1000 ricerche

Su richiesta

Modelli più grandi, che carichiamo alla prima chiamata invece di tenerli occupati a vuoto. Si usano esattamente come gli altri — stesso endpoint, stesso codice — con un’attesa sulla prima richiesta, poi rispondono come tutti finché restano in uso.

Non è un limite ma una scelta: la capacità ferma su un modello che nessuno sta usando è capacità sottratta a chi in quel momento ne ha bisogno.

Mistral Large 2

mistral-large-2

avvio su richiesta

Modello europeo di grande taglia, fra i migliori sul ragionamento articolato e sui testi lunghi. Utile quando la qualità della risposta conta più del tempo di risposta.

CHF 1.50 in entrata · CHF 4.50 in uscita, per milione di token

Qwen 2.5 72B

qwen2.5-72b-instruct

avvio su richiesta

Il più capace fra i modelli densi di questa taglia: analisi complesse, ragionamento matematico, generazione di codice. Multilingua, italiano compreso.

CHF 1.00 in entrata · CHF 3.00 in uscita, per milione di token

DeepSeek-R1 Distill 70B

deepseek-r1-distill-70b

avvio su richiesta

Mostra il proprio ragionamento passo per passo prima di rispondere. Quando serve capire come è arrivato a una conclusione — e non solo quale sia — è il modello giusto.

CHF 1.00 in entrata · CHF 3.00 in uscita, per milione di token

Se vi serve un modello che non è in elenco

Chiedetecelo. Qualunque modello a pesi aperti che stia nella capacità che abbiamo lo possiamo aggiungere: è un’operazione meccanica, non un progetto. L’elenco qui sopra è quello che serviamo oggi, non il confine di quello che possiamo servire.

Quello che invece non facciamo è rivendere i modelli chiusi di OpenAI o Anthropic: non potremmo farli girare da noi, e quindi non potremmo prendere nessuno degli impegni che prendiamo sul resto.

Scriveteci quale vi serve →

Audio

Trascrizione con whisper-1 e whisper-1-hd, sintesi vocale con le voci paola e riccardo in italiano, amy e ryan in inglese, thorsten in tedesco, siwis in francese. Sono accettati anche i nomi delle voci di OpenAI come sinonimi. Dettagli in Audio API.