IT ▾
Ottieni la chiave API

LLM Inference APIPrezzi

API di inferenza: prezzi semplici e trasparenti

I crediti prepagati alimentano ogni richiesta sulla nostra API di inferenza a consumo, con tariffe trasparenti per token e senza costi di abbonamento nascosti. Il tuo saldo copre esattamente l'utilizzo, garantendo costi prevedibili dal primo all'ultimo token.

$0,25per 1M token di input
$1,00Token di output / 1M
100.000finestra di contesto
$0,50credito di prova
300richieste al minuto

Nessun abbonamento. Il credito prepagato non scade mai.

Calcolatore dei costi

$0.00

Esempi di calcolo

Riassumere un lungo documento tecnico

Elaborare un prompt di 50.000 token per generare un riepilogo di 1.000 token costa $0,0125 per l'input e $0,001 per l'output, per un totale di $0,0135. Questo carico di lavoro rientra agevolmente nella nostra finestra di contesto da 100k e dimostra un'elaborazione batch a basso costo.

Sessione chat per utenti avanzati

Una sessione con una finestra di contesto da 10.000 token e 2.000 token di output costa $0,0025 per l'input e $0,002 per l'output. Il totale è $0,0045, dimostrando che anche con un contesto consistente, il modello per token rimane economico per l'uso interattivo.

Generazione di contenuti ad alto volume

Generare 50.000 token di output da un piccolo prompt di 1.000 token costa $0,00025 per l'input e $0,05 per l'output. Il totale è $0,05025, illustrando che i token di output determinano la maggior parte del costo nei flussi di lavoro basati sui contenuti.

Prezzi per token

La nostra API di inferenza addebita strettamente in base al volume di token, con token di input a 0,25 $ per milione e token di output a 1,00 $ per milione. Questa struttura riflette la differenza computazionale tra la lettura del contesto e la generazione di testo. I token di input coprono la finestra di contesto da 100.000 token, permettendoti di inviare prompt grandi o cronologie di conversazioni. I token di output sono fatturati per la generazione del modello. Poiché non includiamo funzionalità come la generazione di immagini o audio, paghi solo per il testo che elabori effettivamente. Questo modello pay-as-you-go garantisce che gli utenti ad alto volume non paghino troppo per funzionalità inutilizzate. I prezzi sono trasparenti, senza sovraccarichi per richiesta o costi minimi. Puoi calcolare il costo esatto moltiplicando i conteggi dei token per questi tassi. Questo approccio mantiene i costi prevedibili sia per le interazioni brevi che per gli scenari di hosting LLM a lungo termine.

Crediti prepagati

Ogni richiesta viene detratta dal tuo saldo prepagato, che non scade mai. Ricarichi con un minimo di 10 $ utilizzando criptovalute (USDT o USDC). Questo modello garantisce che il tuo utilizzo non possa mai superare quanto hai caricato, fornendo un controllo rigoroso del budget. A differenza dei servizi in abbonamento, paghi solo per ciò che consumi, rendendolo un efficiente proxy LLM per carichi di lavoro variabili. I crediti vengono applicati istantaneamente, consentendo accesso immediato all'API. Non ci sono canoni mensili o addebiti ricorrenti, quindi puoi ricaricare solo quando necessario. Questa flessibilità supporta gli sviluppatori che hanno bisogno di capacità a picco o vogliono testare il LLM senza censura senza impegnarsi in un contratto a lungo termine. Il tuo saldo rimane disponibile indefinitamente, quindi puoi mettere in pausa l'utilizzo senza perdere i fondi.

Crediti bonus

Premiamo ricariche più grandi con crediti bonus per estendere ulteriormente il tuo utilizzo. L'aggiunta di 50 $ garantisce un bonus del 5%, mentre 100 $ aggiunge un bonus del 10% al tuo account. Questi bonus vengono applicati al tuo saldo prepagato e utilizzati per il consumo standard di token. Questa funzione riduce il costo effettivo per token per gli utenti avanzati che mantengono un saldo più elevato. I crediti bonus non scadono e sono soggetti alle stesse regole di utilizzo dei tuoi fondi principali. Questa struttura supporta un utilizzo coerente del gateway LLM senza l'attrito di transazioni piccole e frequenti. Rende anche l'API di inferenza più conveniente per team o individui con esigenze prevedibili e continuative. I crediti bonus vengono aggiunti automaticamente al termine della ricarica con successo.

Limiti e cosa è incluso

Stesso prezzo per tutto: function calling e modalità JSON senza costi extra.

VoceValore
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Output massimofino al resto della finestra di 64.000 token; max_tokens opzionale (nessun limite separato)
Finestra di contesto64.000 token (input + output)
Modalità JSONresponse_format: {"type": "json_object"}
Concorrenza8 richieste contemporanee per chiave
Limite di frequenza300 richieste al minuto per chiave
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Bonus+5% da $50, +10% da $100
Scadenzail credito pagato non scade, nessun abbonamento

Specifiche complete e codici di errore nella documentazione.

Domande e risposte

I crediti prepagati scadono?

No, i tuoi crediti prepagati non scadono mai. Puoi ricaricare il tuo account in qualsiasi momento e il saldo rimane disponibile indefinitamente finché non lo utilizzi per le richieste API.

Cosa succede se supero il limite di richieste?

Se superi il limite di 300 richieste al minuto, riceverai un errore standard del limite di richieste. Il tuo saldo prepagato non è influenzato dai limiti di velocità; devi semplicemente attendere che la finestra si resetti prima di inviare altre richieste.

Posso usare l'API per scopi commerciali?

Sì, il nostro <strong>LLM senza censura</strong> è disponibile per uso adulto legale, incluse le applicazioni commerciali. Finché il contenuto non coinvolge contenuti sessuali con minori, puoi utilizzare l'API per qualsiasi scopo legale, inclusi business, ricerca o intrattenimento.

Come posso monitorare l'utilizzo dei token?

Puoi monitorare l'utilizzo dei token direttamente nella dashboard del tuo account. Ogni risposta API include i conteggi dei token sia per l'input che per l'output, permettendoti di verificare i costi. Puoi anche controllare il saldo residuo in qualsiasi momento per assicurarti di avere crediti sufficienti per la tua prossima richiesta.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API