Catalogo
Catalogo dei modelli
Cosa possiamo servirvi: quello già caricato e quello che accendiamo su richiesta.
Pronti all'uso
Già caricati: la prima richiesta risponde senza attesa di avvio. Sono 7.
Apertus 70B
apertus-70b-instruct
Il modello svizzero della Swiss AI Initiative — EPFL, ETH di Zurigo e Centro svizzero di calcolo scientifico. Parla italiano, tedesco, francese, inglese e romancio. È la scelta predefinita per la conversazione e per le risposte sui vostri documenti.
CHF 1.00 in entrata · CHF 3.00 in uscita, per milione di token
Gemma 4 26B
gemma-4-26b
Legge anche le immagini, non solo il testo: utile per fotografie di documenti, scansioni e schermate. Buono nel restituire dati strutturati da un testo libero, quindi nell’estrarre campi da un contratto o da una fattura.
CHF 0.30 in entrata · CHF 0.60 in uscita, per milione di token
Qwen 2.5 32B
qwen2.5:32b
Il più capace fra i modelli di taglia media: adatto quando la domanda richiede di ragionare su più passaggi, non solo di riformulare. Consigliato per analisi e sintesi di documenti complessi.
CHF 0.30 in entrata · CHF 0.90 in uscita, per milione di token
Qwen 2.5 14B
qwen2.5:14b
Buon compromesso fra qualità e rapidità. La scelta giusta per il volume: classificazione, riassunti, prime bozze, risposte a domande frequenti.
CHF 0.15 in entrata · CHF 0.45 in uscita, per milione di token
Qwen 2.5 1.5B
qwen2.5:1.5b
Modello leggero e molto rapido, per compiti semplici e ripetitivi dove conta il tempo di risposta più della sfumatura.
CHF 0.05 in entrata · CHF 0.10 in uscita, per milione di token
BGE-M3 (Embeddings)
bge-m3
Trasforma un testo in una rappresentazione numerica che permette di cercare per significato invece che per parole esatte. È il motore della ricerca sui vostri documenti. Funziona su testi in lingue diverse, anche mescolate.
CHF 0.12 in entrata · CHF 0.00 in uscita, per milione di token
BGE Reranker v2 m3
bge-reranker-v2-m3
Seconda passata sui risultati di una ricerca: rilegge i candidati insieme alla domanda e li riordina per pertinenza reale. Serve a far arrivare in cima la risposta giusta, non solo quella che somiglia di più alle parole cercate.
CHF 2.50 ogni 1000 ricerche
Su richiesta
Modelli più grandi, che carichiamo alla prima chiamata invece di tenerli occupati a vuoto. Si usano esattamente come gli altri — stesso endpoint, stesso codice — con un’attesa sulla prima richiesta, poi rispondono come tutti finché restano in uso.
Non è un limite ma una scelta: la capacità ferma su un modello che nessuno sta usando è capacità sottratta a chi in quel momento ne ha bisogno.
Mistral Large 2
mistral-large-2
Modello europeo di grande taglia, fra i migliori sul ragionamento articolato e sui testi lunghi. Utile quando la qualità della risposta conta più del tempo di risposta.
CHF 1.50 in entrata · CHF 4.50 in uscita, per milione di token
Qwen 2.5 72B
qwen2.5-72b-instruct
Il più capace fra i modelli densi di questa taglia: analisi complesse, ragionamento matematico, generazione di codice. Multilingua, italiano compreso.
CHF 1.00 in entrata · CHF 3.00 in uscita, per milione di token
DeepSeek-R1 Distill 70B
deepseek-r1-distill-70b
Mostra il proprio ragionamento passo per passo prima di rispondere. Quando serve capire come è arrivato a una conclusione — e non solo quale sia — è il modello giusto.
CHF 1.00 in entrata · CHF 3.00 in uscita, per milione di token
Se vi serve un modello che non è in elenco
Chiedetecelo. Qualunque modello a pesi aperti che stia nella capacità che abbiamo lo possiamo aggiungere: è un’operazione meccanica, non un progetto. L’elenco qui sopra è quello che serviamo oggi, non il confine di quello che possiamo servire.
Quello che invece non facciamo è rivendere i modelli chiusi di OpenAI o Anthropic: non potremmo farli girare da noi, e quindi non potremmo prendere nessuno degli impegni che prendiamo sul resto.
Audio
Trascrizione con whisper-1 e whisper-1-hd, sintesi vocale con le voci
paola e riccardo in italiano, amy e ryan in
inglese, thorsten in tedesco, siwis in francese. Sono accettati anche i
nomi delle voci di OpenAI come sinonimi. Dettagli in Audio API.