Résumé de recherche approfondie
Un article de recherche de 40k tokens traité pour un résumé de 2k tokens. Entrée : 40 000 tokens × $0,25/1M = $0,01. Sortie : 2 000 tokens × $1,00/1M = $0,002. Total : $0,012.
Ne devinez plus votre facture. Notre API LLM au paiement à l'usage applique strictement les coûts aux tokens consommés, avec une tarification transparente par million et sans frais d'abonnement cachés.
Pas d'abonnement. Le crédit prépayé n'expire jamais.
Un article de recherche de 40k tokens traité pour un résumé de 2k tokens. Entrée : 40 000 tokens × $0,25/1M = $0,01. Sortie : 2 000 tokens × $1,00/1M = $0,002. Total : $0,012.
Génération d'une histoire de 3 000 mots (environ 4k tokens) à partir d'un prompt court (500 tokens). Entrée : 500 tokens × $0,25/1M = $0,000125. Sortie : 4 000 tokens × $1,00/1M = $0,004. Total : $0,004125.
Cinq requêtes rapides pour tester le comportement du modèle sans censure, chacune avec 100 tokens d'entrée et 50 tokens de sortie. Entrée : 500 tokens × $0,25/1M = $0,000125. Sortie : 250 tokens × $1,00/1M = $0,00025. Total : $0,000375.
Notre modèle de tarification est strictement basé sur les tokens, reflétant les ressources de calcul réelles consommées par vos requêtes. Nous facturons $0,25 par 1 million de tokens d'entrée et $1,00 par 1 million de tokens de sortie. Cette structure est standard pour les API LLM modernes, mais nous nous assurons que vous sachiez exactement ce pour quoi vous payez. Les tokens d'entrée couvrent l'utilisation de votre prompt et de votre fenêtre de contexte, tandis que les tokens de sortie couvrent la réponse générée par le modèle. Comme nous utilisons un seul modèle sans censure, vous ne payez jamais pour une capacité inoccupée ou des niveaux de modèle inutilisés. Le ratio entre tokens d'entrée et tokens de sortie varie selon le cas d'usage, mais le calcul reste constant : le coût est égal aux tokens divisés par un million, multiplié par le tarif. Cette transparence vous permet de budgétiser précisément les tâches de génération de texte à fort volume sans vous soucier des frais de sortie cachés ou des pénalités par nombre de requêtes.
Nous fonctionnons sur un système de crédit prépayé, ce qui signifie que vous rechargez vos fonds une fois et les dépensez selon vos besoins. Il n'y a pas d'abonnements mensuels, de plans à renouvellement automatique ni de réserves sur carte bancaire. Votre clé API fonctionne immédiatement après le financement, et l'utilisation déduit de votre solde en temps réel. Ce modèle rend vos dépenses prévisibles : vous ne pouvez pas dépasser ce que vous avez chargé. Si votre solde atteint zéro, les requêtes s'arrêtent jusqu'à ce que vous rechargiez. C'est idéal pour les développeurs qui veulent contrôler les coûts strictement ou tester le modèle sans censure sans s'engager dans une facture récurrente. Vous pouvez ajouter des fonds via crypto (USDT ou USDC) à partir de 10 $, et votre crédit n'expire jamais. Cette approche élimine la friction de la dépendance à un fournisseur et garantit que vous ne payez que pour le calcul que vous utilisez réellement.
Pour récompenser une utilisation plus élevée, nous offrons des crédits bonus en plus de vos fonds chargés. Lorsque vous achetez 50 $ ou plus, vous recevez un crédit bonus de 5 %. À 100 $ ou plus, le bonus augmente à 10 %. Ces crédits bonus sont ajoutés à votre compte immédiatement et peuvent être utilisés pour des requêtes API comme vos fonds de base. Cela réduit effectivement votre coût par token pour les recharges plus importantes. Par exemple, un achat de 100 $ vous donne 110 $ de crédit utilisable. Le bonus n'expire pas séparément ; il suit la même règle de non-expiration que votre solde de base. Cette structure récompense le volume sans exiger de contrat à long terme, ce qui facilite l'évolution de votre utilisation LLM sans censure à mesure que votre projet grandit.
Même prix pour tout : appel de fonctions et mode JSON sans supplément.
| Élément | Valeur |
|---|---|
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
Toutes les caractéristiques et codes d'erreur sont dans la documentation.
Non. Une fois les crédits achetés, ils n'expirent jamais, quel que soit le temps écoulé. Vous pouvez recharger aujourd'hui et utiliser les fonds des mois plus tard sans perdre votre solde.
Notre système vérifie votre solde avant le traitement. Si le solde est insuffisant, la requête est rejetée, garantissant que vous ne tombiez jamais en découvert. Vous ne pouvez pas dépenser plus que ce que vous avez chargé.
Les crédits bonus sont appliqués automatiquement lors de l'achat de 50 $ ou plus (bonus de 5 %) ou de 100 $ ou plus (bonus de 10 %). Aucun code à saisir ; le crédit est ajouté à votre compte immédiatement après le paiement.
Non. Pas de frais mensuels, pas de frais par requête, pas de frais cachés. Vous ne payez que pour les tokens consommés par votre entrée et votre sortie. Le seul coût est l'utilisation des tokens.
Créez un compte, copiez la clé, changez l'URL de base. C'est toute la configuration.