Un modèle, neuf prix
Demandez à n'importe quelle API d'inférence quelle version du modèle vient de vous répondre. Presque aucune ne vous le dira. Le même nom recouvre des poids qui varient d'un facteur trois en taille et beaucoup en qualité — et vous payez le même prix dans les deux cas.
Nous publions neuf prix pour Qwen3.8 27B, de 0,75 € à 0,28 € le million de tokens en sortie, et la facture suit les poids qui ont réellement tourné.
Jamais facturé au-dessus du prix affiché
Le prix annoncé est celui du meilleur build. Tout ce qui est en dessous est une remise : le chiffre sur la page est un plafond, pas une moyenne que vous pourriez dépasser.
Un en-tête pose le plancher
-H "X-ElephantPool-Require: quality:reference"
Vos requêtes n'atteignent alors que des machines faisant tourner les poids de référence. C'est un minimum, pas une égalité — une meilleure qualité est toujours acceptée — donc le poser rend votre coût prévisible sans jamais vous coûter un hôte disponible.
Pourquoi le bas de gamme est vraiment bas
Des poids plus petits se décodent plus vite : la machine qui les sert produit plus de tokens à l'heure. Tarifer par build vous répercute ce gain au lieu de le garder. Un modèle de 27 milliards de paramètres à 0,28 € coûte moins que ce qu'une bonne partie du marché demande pour trois fois plus petit.
Et pourquoi vous pouvez vérifier
Chaque requête terminée produit un reçu signé sur la machine qui l'a servie, nommant l'empreinte du fichier de poids chargé. La remise se calcule à partir de cette signature. Un hôte ne peut pas servir le build bon marché et se faire payer le cher, et nous ne pouvons pas vous facturer une qualité que personne n'a livrée.
La référence tarifaire complète est dans la base de connaissances.
Reference
Read next
one model, every card: how a 27b runs on 8 gb
Qwen3.8 27B ships in five builds, from Q5_K_M on a 24 GB card down to IQ2_XXS on 8 GB. Why we split models from builds, what quantization actually costs, and how a quantized KV cache doubled our context overnight.
we stopped projecting your earnings and started measuring them
Most GPU marketplaces advertise what a card could earn. Our dashboard shows what yours measured, and refuses to show a number until it has one. Here is why that choice cost us a nicer-looking page and was still right.