LLM Inference APIPrezzi
API di inferenza: prezzi semplici e trasparenti
I crediti prepagati alimentano ogni richiesta sulla nostra API di inferenza a consumo, con tariffe trasparenti per token e senza costi di abbonamento nascosti. Il tuo saldo copre esattamente l'utilizzo, garantendo costi prevedibili dal primo all'ultimo token.
Nessun abbonamento. Il credito prepagato non scade mai.
Calcolatore dei costi
Esempi di calcolo
Riassumere un lungo documento tecnico
Elaborare un prompt di 50.000 token per generare un riepilogo di 1.000 token costa $0,0125 per l'input e $0,001 per l'output, per un totale di $0,0135. Questo carico di lavoro rientra agevolmente nella nostra finestra di contesto da 100k e dimostra un'elaborazione batch a basso costo.
Sessione chat per utenti avanzati
Una sessione con una finestra di contesto da 10.000 token e 2.000 token di output costa $0,0025 per l'input e $0,002 per l'output. Il totale è $0,0045, dimostrando che anche con un contesto consistente, il modello per token rimane economico per l'uso interattivo.
Generazione di contenuti ad alto volume
Generare 50.000 token di output da un piccolo prompt di 1.000 token costa $0,00025 per l'input e $0,05 per l'output. Il totale è $0,05025, illustrando che i token di output determinano la maggior parte del costo nei flussi di lavoro basati sui contenuti.
Prezzi per token
La nostra API di inferenza addebita strettamente in base al volume di token, con token di input a 0,25 $ per milione e token di output a 1,00 $ per milione. Questa struttura riflette la differenza computazionale tra la lettura del contesto e la generazione di testo. I token di input coprono la finestra di contesto da 100.000 token, permettendoti di inviare prompt grandi o cronologie di conversazioni. I token di output sono fatturati per la generazione del modello. Poiché non includiamo funzionalità come la generazione di immagini o audio, paghi solo per il testo che elabori effettivamente. Questo modello pay-as-you-go garantisce che gli utenti ad alto volume non paghino troppo per funzionalità inutilizzate. I prezzi sono trasparenti, senza sovraccarichi per richiesta o costi minimi. Puoi calcolare il costo esatto moltiplicando i conteggi dei token per questi tassi. Questo approccio mantiene i costi prevedibili sia per le interazioni brevi che per gli scenari di hosting LLM a lungo termine.
Crediti prepagati
Ogni richiesta viene detratta dal tuo saldo prepagato, che non scade mai. Ricarichi con un minimo di 10 $ utilizzando criptovalute (USDT o USDC). Questo modello garantisce che il tuo utilizzo non possa mai superare quanto hai caricato, fornendo un controllo rigoroso del budget. A differenza dei servizi in abbonamento, paghi solo per ciò che consumi, rendendolo un efficiente proxy LLM per carichi di lavoro variabili. I crediti vengono applicati istantaneamente, consentendo accesso immediato all'API. Non ci sono canoni mensili o addebiti ricorrenti, quindi puoi ricaricare solo quando necessario. Questa flessibilità supporta gli sviluppatori che hanno bisogno di capacità a picco o vogliono testare il LLM senza censura senza impegnarsi in un contratto a lungo termine. Il tuo saldo rimane disponibile indefinitamente, quindi puoi mettere in pausa l'utilizzo senza perdere i fondi.
Crediti bonus
Premiamo ricariche più grandi con crediti bonus per estendere ulteriormente il tuo utilizzo. L'aggiunta di 50 $ garantisce un bonus del 5%, mentre 100 $ aggiunge un bonus del 10% al tuo account. Questi bonus vengono applicati al tuo saldo prepagato e utilizzati per il consumo standard di token. Questa funzione riduce il costo effettivo per token per gli utenti avanzati che mantengono un saldo più elevato. I crediti bonus non scadono e sono soggetti alle stesse regole di utilizzo dei tuoi fondi principali. Questa struttura supporta un utilizzo coerente del gateway LLM senza l'attrito di transazioni piccole e frequenti. Rende anche l'API di inferenza più conveniente per team o individui con esigenze prevedibili e continuative. I crediti bonus vengono aggiunti automaticamente al termine della ricarica con successo.
Limiti e cosa è incluso
Stesso prezzo per tutto: function calling e modalità JSON senza costi extra.
| Voce | Valore |
|---|---|
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 64.000 token; max_tokens opzionale (nessun limite separato) |
| Finestra di contesto | 64.000 token (input + output) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
Specifiche complete e codici di errore nella documentazione.
Domande e risposte
I crediti prepagati scadono?
No, i tuoi crediti prepagati non scadono mai. Puoi ricaricare il tuo account in qualsiasi momento e il saldo rimane disponibile indefinitamente finché non lo utilizzi per le richieste API.
Cosa succede se supero il limite di richieste?
Se superi il limite di 300 richieste al minuto, riceverai un errore standard del limite di richieste. Il tuo saldo prepagato non è influenzato dai limiti di velocità; devi semplicemente attendere che la finestra si resetti prima di inviare altre richieste.
Posso usare l'API per scopi commerciali?
Sì, il nostro <strong>LLM senza censura</strong> è disponibile per uso adulto legale, incluse le applicazioni commerciali. Finché il contenuto non coinvolge contenuti sessuali con minori, puoi utilizzare l'API per qualsiasi scopo legale, inclusi business, ricerca o intrattenimento.
Come posso monitorare l'utilizzo dei token?
Puoi monitorare l'utilizzo dei token direttamente nella dashboard del tuo account. Ogni risposta API include i conteggi dei token sia per l'input che per l'output, permettendoti di verificare i costi. Puoi anche controllare il saldo residuo in qualsiasi momento per assicurarti di avere crediti sufficienti per la tua prossima richiesta.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.
Ottieni la chiave API