Ein Modell, neun Preise
Fragen Sie eine beliebige Inferenz-API, welche Version des Modells Ihnen gerade geantwortet hat. Fast keine sagt es. Derselbe Name deckt Gewichte ab, die sich um den Faktor drei in der Größe und deutlich in der Qualität unterscheiden — und Sie zahlen so oder so denselben Preis.
Wir veröffentlichen neun Preise für Qwen3.8 27B, von 0,75 € bis 0,28 € je Million Ausgabe-Token, und die Rechnung folgt den Gewichten, die wirklich liefen.
Nie über dem ausgewiesenen Preis
Der genannte Preis ist der des besten Builds. Alles darunter ist ein Nachlass: die Zahl auf der Seite ist eine Obergrenze, kein Durchschnitt, den Sie überschreiten könnten.
Ein Header setzt die Untergrenze
-H "X-ElephantPool-Require: quality:reference"
Ihre Anfragen erreichen dann nur Maschinen mit Referenzgewichten. Es ist ein Minimum, keine Gleichheit — bessere Qualität wird immer akzeptiert — also macht es Ihre Kosten planbar, ohne je einen verfügbaren Host zu kosten.
Warum das günstige Ende wirklich günstig ist
Kleinere Gewichte dekodieren schneller, also produziert die Maschine mehr Token pro Stunde. Preise je Build geben Ihnen das weiter, statt es zu behalten. Ein Modell mit 27 Milliarden Parametern für 0,28 € kostet weniger, als ein großer Teil des Marktes für ein Drittel der Größe verlangt.
Und warum Sie es prüfen können
Jede abgeschlossene Anfrage erzeugt eine auf der bedienenden Maschine signierte Quittung mit dem Digest der geladenen Gewichtsdatei. Der Nachlass wird aus dieser Signatur berechnet. Ein Host kann nicht den günstigen Build bedienen und den teuren abrechnen, und wir können Ihnen keine Qualität berechnen, die niemand geliefert hat.
Die vollständige Preisreferenz steht in der Wissensdatenbank.
Reference
Read next
one model, every card: how a 27b runs on 8 gb
Qwen3.8 27B ships in five builds, from Q5_K_M on a 24 GB card down to IQ2_XXS on 8 GB. Why we split models from builds, what quantization actually costs, and how a quantized KV cache doubled our context overnight.
we stopped projecting your earnings and started measuring them
Most GPU marketplaces advertise what a card could earn. Our dashboard shows what yours measured, and refuses to show a number until it has one. Here is why that choice cost us a nicer-looking page and was still right.