LLM Inference APITarification
API d'inférence : Tarification simple et transparente
Les crédits prépayés alimentent chaque requête de notre API d'inférence à l'usage, avec des tarifs transparents par token et sans frais d'abonnement cachés. Votre solde couvre exactement l'utilisation, garantissant des coûts prévisibles du premier au dernier token.
Pas d'abonnement. Le crédit prépayé n'expire jamais.
Calculateur de coûts
Exemples chiffrés
Résumé d'un long document technique
Le traitement d'un prompt de 50 000 tokens pour générer un résumé de 1 000 tokens coûte 0,0125 $ en entrée et 0,001 $ en sortie, soit un total de 0,0135 $. Cette charge de travail s'inscrit bien dans notre fenêtre de contexte de 100 k et démontre un traitement par lots à faible coût.
Session de chat pour utilisateurs avancés
Une session utilisant une fenêtre de contexte de 10 000 tokens avec 2 000 tokens de sortie coûte 0,0025 $ en entrée et 0,002 $ en sortie. Le total est de 0,0045 $, ce qui montre que même avec un contexte substantiel, le modèle par token reste économique pour une utilisation interactive.
Génération de contenu à haut volume
La génération de 50 000 tokens de sortie à partir d'un petit prompt de 1 000 tokens coûte 0,00025 $ en entrée et 0,05 $ en sortie. Le total est de 0,05025 $, illustrant que les tokens de sortie représentent la majeure partie du coût dans les flux de travail lourds en contenu.
Tarification par token
Notre API d'inférence facture strictement au volume de tokens, avec des tokens d'entrée à 0,25 $ par million et des tokens de sortie à 1,00 $ par million. Cette structure reflète la différence de calcul entre la lecture du contexte et la génération de texte. Les tokens d'entrée couvrent la fenêtre de contexte de 100 000 tokens, vous permettant de transmettre de gros prompts ou des historiques de conversation. Les tokens de sortie sont facturés pour la génération du modèle. Comme nous ne proposons pas de fonctionnalités groupées comme la génération d'images ou d'audio, vous ne payez que pour le texte que vous traitez réellement. Ce modèle d'API IA paiement à l'usage garantit que les utilisateurs à fort volume ne paient pas trop cher pour des capacités inutilisées. La tarification est transparente, sans frais par requête ni minimums. Vous pouvez calculer votre coût exact en multipliant vos comptes de tokens par ces tarifs. Cette approche rend les coûts prévisibles pour les interactions courtes et les scénarios de hébergement LLM à long terme.
Crédits prépayés
Chaque requête est déduite de votre solde prépayé, qui n'expire jamais. Vous rechargez avec un minimum de 10 $ en crypto (USDT ou USDC). Ce modèle garantit que votre utilisation ne peut jamais dépasser ce que vous avez chargé, offrant un contrôle strict du budget. Contrairement aux services d'abonnement, vous ne payez que ce que vous consommez, ce qui en fait un proxy LLM efficace pour les charges de travail variables. Les crédits sont appliqués instantanément, permettant un accès immédiat à l'API. Il n'y a pas de frais mensuels ni de frais récurrents, vous pouvez donc recharger uniquement lorsque cela est nécessaire. Cette flexibilité soutient les développeurs qui ont besoin d'une capacité de pointe ou qui veulent tester le LLM sans censure sans s'engager dans un contrat à long terme. Votre solde reste disponible indéfiniment, vous pouvez donc suspendre l'utilisation sans perdre vos fonds.
Crédits bonus
Nous récompensons les rechargements plus importants par des crédits bonus pour étendre votre utilisation. L'ajout de 50 $ octroie une prime de 5 %, tandis que 100 $ ajoutent une prime de 10 % à votre compte. Ces bonus sont appliqués à votre solde prépayé et utilisés pour la consommation standard de tokens. Cette fonctionnalité réduit le coût effectif par token pour les utilisateurs avancés qui maintiennent un solde plus élevé. Les crédits bonus n'expirent jamais et sont soumis aux mêmes règles d'utilisation que vos fonds principaux. Cette structure prend en charge une utilisation cohérente de la passerelle LLM sans la friction de transactions petites et fréquentes. Elle rend également l'API d'inférence plus rentable pour les équipes ou les particuliers ayant des besoins continus et prévisibles. Les crédits bonus sont ajoutés automatiquement après un rechargement réussi.
Limites et inclus
Même prix pour tout : appel de fonctions et mode JSON sans supplément.
| Élément | Valeur |
|---|---|
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 64 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Fenêtre de contexte | 64 000 tokens (entrée + sortie) |
| Mode JSON | response_format: {"type": "json_object"} |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
Toutes les caractéristiques et codes d'erreur sont dans la documentation.
Questions et réponses
Les crédits prépayés expirent-ils ?
Non, vos crédits prépayés n'expirent jamais. Vous pouvez recharger votre compte à tout moment ; le solde reste disponible indéfiniment jusqu'à ce que vous l'utilisiez pour des requêtes API.
Que se passe-t-il si je dépasse ma limite de requêtes ?
Si vous dépassez la limite de 300 requêtes par minute, vous recevrez une erreur de limite de débit standard. Votre solde prépayé n'est pas affecté par les limites de débit ; vous devez simplement attendre la réinitialisation de la fenêtre avant d'envoyer d'autres requêtes.
Puis-je utiliser l'API à des fins commerciales ?
Oui, notre <strong>LLM sans censure</strong> est disponible pour une utilisation adulte légale, y compris commerciale. Tant que le contenu ne comporte pas de contenu sexuel impliquant des mineurs, vous pouvez utiliser l'API à toute fin légale, y compris commerciale, de recherche ou de divertissement.
Comment suivre ma consommation de tokens ?
Vous pouvez surveiller votre consommation de tokens directement dans le tableau de bord de votre compte. Chaque réponse API inclut les compteurs de tokens d'entrée et de sortie, ce qui vous permet de vérifier vos coûts. Vous pouvez également consulter votre solde restant à tout moment pour vous assurer d'avoir suffisamment de crédits pour votre prochaine requête.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute l'installation.
Obtenir une clé API