Quanto costa questo testo in ogni modello?
Lo stesso lavoro costa ordini di grandezza diversi a seconda di chi lo esegue. Incolla il testo e guarda il prezzo affiancato, dal più economico al più caro.
- Modulo
- Router
- Ingresso
- Un testo
- Dove gira
- Il tuo browser
- Costo
- Gratis, senza registrazione
Stima per scrittura: latino ≈ 4 caratteri per token; cinese, giapponese e coreano consumano molto di più. Prezzi pubblici di listino, in dollari.
Lo stesso testo, lo stesso lavoro, prezzi che differiscono di 100 volte
I modelli di IA addebitano per token, frammenti di parole, in input e in output. Quello che quasi nessuno guarda è quanto varia questo prezzo: lo stesso testo che costa pochi centesimi su un modello leggero costa decine di volte di più su un modello di punta. Per un'attività semplice, questa differenza è denaro buttato ogni mese.
Lo strumento stima i token del tuo testo, aggiunge ciò che prevedi come risposta e applica il prezzo pubblico di ogni modello. L'elenco è ordinato dal più economico al più costoso, e i modelli a pesi aperti sono contrassegnati, perché puoi anche eseguirli in autonomia.
- 01
Incolli il testo
Prompt, documento, trascrizione: qualsiasi cosa. Nulla esce dal browser: il conteggio viene fatto qui.
- 02
Indichi la lunghezza della risposta
L’uscita costa di solito da tre a cinque volte l’entrata, quindi ignorarla dimezza la stima del conto.
- 03
Il confronto esce ordinato per prezzo
Dal più economico al più caro, con la barra che mostra la distanza reale tra loro.
- 01
Cos’è un token, in fondo?
- È l'unità con cui il modello legge e scrive, di solito una parte di parola. In portoghese, una parola comune corrisponde di solito a uno o due token. In cinese o giapponese, un singolo carattere spesso vale già un token intero, per questo lo stesso contenuto costa di più in queste lingue.
- 02
Il conteggio è esatto?
- No, e nessuna stima che non usi il tokenizzatore ufficiale di ogni modello lo sarà. Ogni famiglia tokenizza in modo diverso. La stima qui è calibrata per la scrittura e serve a dimensionare costo e contesto, per chiudere la fattura, usa il numero restituito dal provider nella risposta API.
- 03
Il mio testo viene inviato a un server?
- No. Conteggio e calcolo avvengono interamente nel tuo browser. È per questo che puoi incollare qui un documento che non incolleresti in uno strumento che carica il contenuto.
- 04
Perché entrata e uscita hanno prezzi diversi?
- Perché generare costa più che leggere. Il modello elabora l'input in una volta sola, ma produce l'output token per token, ed è questa generazione a consumare più calcolo. Perciò l'output costa, di norma, da tre a cinque volte l'input.
- 05
Il modello più caro è sempre il migliore?
- Non per ogni compito. Classificare, estrarre un campo e riassumere testo breve li risolvono bene i modelli leggeri. Riservare il modello caro a ciò che richiede davvero ragionamento è la differenza tra un conto sano e uno assurdo a fine mese.
- 06
Come si sceglie in pratica, senza puntare su uno solo?
- Instradando per attività: la richiesta semplice va al modello economico, quella difficile sale. Farlo a mano in ogni chiamata è impraticabile, è esattamente il lavoro del modulo Router, che decide la destinazione e impara anche dal risultato.
Hai visto la differenza di prezzo. Chi decide la destinazione?
Scegliere il modello giusto a ogni chiamata è ciò che fa il modulo Router: una chiave per tutto il mercato, con la decisione presa per compito e non per contratto.
