offene ki-modelle.
verteilter gpu-pool.
Eine OpenAI-kompatible API. Open-Source-Modelle. Bereitgestellt von einem verifizierten GPU-Pool quer durch Europa — vom Gaming-PC bis zum Rechenzentrum. Entwickler zahlen weniger. Hardware-Besitzer werden für jeden Token bezahlt, den ihre Maschinen liefern.
So funktioniert ElephantPool
Entwickler bringen Anfragen. Hardware-Besitzer bringen GPUs. Unser Scheduler, unser Verifizierer und unsere Zahlungsschienen sitzen dazwischen — und nehmen 20%, nur wenn Tokens fließen.
Entwickler rufen die API auf
Tauschen Sie Ihre Basis-URL, behalten Sie Ihren Code: ein OpenAI-kompatibler Endpoint für Llama, Qwen, DeepSeek, gpt-oss. Bezahlung pro Token, Prepaid-Guthaben, kein Abo.
Der Pool bedient sie
Der Scheduler leitet jede Anfrage an die beste verifizierte Maschine — nach Geschwindigkeit, Preis, Reputation und (auf Wunsch) reiner EU-Residenz. Jeder Job erzeugt eine kryptografische Quittung.
Besitzer werden bezahlt
80% des Umsatzes jedes Tokens gehen an die Maschine, die ihn geliefert hat. Monatliche SEPA-Auszahlung über Stripe. Bezahlt für geleistete Arbeit — nichts zu kaufen, nichts zu binden.
Die Aufteilung ist öffentlich und gilt für jeden Job im Netzwerk.
Modelle & Preise
Die neuesten offenen Modelle, transparente Preise pro Token, in Euro. Die EU-souveräne Stufe routet ausschließlich zu Maschinen in der EU, von uns geprüft statt von ihnen behauptet — und unterbietet trotzdem jede souveräne Cloud.
| Modell | Standard € / M Tokens ein · aus |
EU-souverän € / M Tokens ein · aus |
Anderswo günstigster US · EU-souverän |
|---|---|---|---|
| Llama 3.1 8B 8B dense · 128K |
€0.03 · €0.06 | €0.05 · €0.10 | US $0.02 · $0.04 DeepInfraEU — |
| Qwen3.8 27B 27B dense · 262K · Apache-2.0 · new |
€0.25 · €1.50 | €0.35 · €2.00 | US $0.40 · $3.00 ChutesEU — |
| Gemma 4 26B-A4B 26B MoE · 256K · Apache-2.0 |
€0.06 · €0.25 | €0.10 · €0.35 | US $0.07 · $0.34 DeepInfraEU — |
| Llama 3.3 70B 70B dense · 128K |
€0.30 · €0.50 | €0.35 · €0.55 | US $0.10 · $0.32 DeepInfraEU €0.65 · €0.65 IONOS |
| gpt-oss-120b 117B MoE · 131K · Apache-2.0 |
€0.06 · €0.30 | €0.10 · €0.45 | US $0.03 · $0.17 CoreWeaveEU €0.08 · €0.40 OVHcloud |
| DeepSeek V4-Flash 304B MoE · 1M · MIT |
€0.15 · €0.35 | €0.25 · €0.55 | US $0.08 · $0.18 DeepInfraEU €0.40 · €0.80 Scaleway |
| MiniMax M3 427B MoE · 1M · community license |
€0.25 · €1.00 | €0.35 · €1.30 | US $0.28 · $1.10 DeepInfraEU — |
| GLM-5.2 753B MoE · 1M · MIT |
€0.45 · €1.40 | €0.60 · €1.80 | US $0.48 · $1.49 NovitaEU €1.80 · €5.50 Scaleway |
| Qwen3.5 397B-A17B 397B MoE · 262K · Apache-2.0 |
€0.40 · €2.50 | €0.50 · €3.00 | US $0.30 · $1.93 DigitalOceanEU €0.60 · €3.60 Scaleway/OVH |
Angestrebte Launch-Preise. Batch-Stufe: −50%. Wettbewerberpreise aus öffentlichen Preislisten, August 2026. Kostenloses Startguthaben auf kleinen Modellen für frühe Nutzer.
Alle Katalogmodelle sind open-weight (Apache-2.0-, MIT- oder Llama-/Community-Lizenzen — pro Modell in der API verlinkt). Multi-Node-Giganten (Qwen3.8 2.4T, Kimi K3, DeepSeek V4-Pro) stehen auf der Roadmap, nicht im Launch-Katalog.
Drop-in-Ersatz
OpenAI-kompatibles /v1/chat/completions, Streaming inklusive. Eine Basis-URL ändern und Sie sind im Pool.
DSGVO by Design
Prompts berühren nie eine Festplatte, werden nie fürs Training verwendet, und die EU-souveräne Stufe verlässt nie Maschinen, die wir in der EU verortet haben. DPA verfügbar.
Smartes Routing, smarte Ersparnis
Wählen Sie ein Modell — oder wählen Sie auto und lassen Sie den Router jede Anfrage an das günstigste Modell schicken, das sie bewältigen kann. Batch-API zum halben Preis.
Ihre GPU hat jetzt einen festen Job
Installieren Sie mahout, unseren Open-Source-Agenten — benannt nach der Person, die einen Elefanten führt. Er benchmarkt Ihre Maschine, liefert Modelle, die sie bewältigen kann, und sorgt dafür, dass Sie für jeden Token bezahlt werden. Voller NVIDIA- und AMD-Support, vom ersten Tag an.
RTX 3090 / 3080
RTX 4090 / 5090
RX 7900 XT / XTX
A6000 · A100 · H100
Sicher by Design
mahout ist Open Source. Es führt nur signierte Engines in sandboxed Containern aus — Gewichte nur lesbar, null Netzwerk-Egress, niemals Client-Code. Keine eingehenden Ports auf Ihrem Router.
Ihre Maschine, Ihre Regeln
Legen Sie Verfügbarkeitsfenster, Leistungslimits, Speicherkontingent und einen Mindestpreis fest. Auto-Pause, wenn Sie spielen oder arbeiten. Stopp mit einem Klick, jederzeit.
Bezahlt für Arbeit, monatlich
80% jedes Tokens, den Ihre Maschine liefert, nachverfolgt durch kryptografische Quittungen, die Sie selbst prüfen können. Monatliche SEPA-Auszahlung ab €50, abgewickelt über Stripe. Garantierte Start-Arbeit in Ihrer ersten Woche.
Was könnte Ihre Hardware verdienen?
Schätzungen für kontinuierlich gebatchtes Serving zu unserem Launch-Preisbuch, mit 80% des Token-Umsatzes als Auszahlung an Sie. Sie werden für Arbeit bezahlt, die tatsächlich an Ihre Maschine geroutet wird — das ist eine Schätzung, kein Versprechen.
Verwendete Annahmen:
- Launch-Preisbuch, Continuous Batching
- Ihr Anteil: 80% des Token-Umsatzes
- Leistungsaufnahme unter Last pro Rig, Modell für Modell ausgewiesen
- Die Auslastung hängt von der Netzwerk-Nachfrage in Ihrer Region ab
⚠️ Nur Schätzungen. Sie werden für Tokens bezahlt, die Ihre Hardware tatsächlich liefert; das Volumen hängt von der Netzwerk-Nachfrage, dem Benchmark Ihrer Maschine, der Verfügbarkeit und der Reputation ab. Dies ist Bezahlung für eine Leistung, die Sie erbringen — keine Geldanlage, kein Finanzprodukt. An estimate at the utilisation you chose, not a promise of demand. Measured earnings — from a benchmark on your own card — live in your dashboard.
Vertrauen Sie uns nicht. Prüfen Sie uns.
Verifizierte Rechenleistung
Jeder Job erzeugt einen Aktivierungs-Fingerabdruck (das TOPLOC-Schema — 258 Bytes pro 32 Tokens). Eine Zufallsstichprobe aller Arbeit wird auf vertrauenswürdiger Hardware wiederholt. Maschinen, die Arbeit fälschen, werden nicht bezahlt — und werden gesperrt.
Öffentliche Quittungen
Signierte Job-Quittungen werden in einem Merkle-Baum gebündelt und alle 10 Minuten auf einer öffentlichen Blockchain verankert. Jeder Host oder Kunde kann unabhängig beweisen, was wann geliefert wurde und was geschuldet war.
Open Source, offene Doku
Der mahout-Agent ist Open Source und auditierbar. Unsere Architektur, Ökonomie und unser Verifizierungsdesign sind veröffentlicht: Lesen Sie das Whitepaper und die technische Spezifikation.
Europäisch, aus Überzeugung
Betrieben aus Belgien von De Buck Technologies. EU-souveräne Stufe mit erzwungenem EU-only-Routing, null Datenspeicherung und einem Standard-DPA — zu etwa dem halben Preis souveräner Clouds.
Eine öffentliche Aufteilung: 80 / 20
80% des Token-Umsatzes an die Maschine, die die Arbeit geleistet hat, 20% ans Netzwerk. Keine versteckten Spannen, keine hauseigene Hardware, die sich bei gleichen Bedingungen vordrängelt.
Gebaut, um zu wachsen
Langfristig trainiert ungenutzte Pool-Kapazität gemeinsam offene Modelle — das Netzwerk, das KI bereitstellt, verbessert sie auch, und zwar offen. Auch diese Roadmap ist öffentlich.
Häufige Fragen
Ist das sicher für meinen PC?
mahout führt ausschließlich fixierte, per Prüfsumme verifizierte Artefakte aus — eine bestimmte Engine-Version und bestimmte Modelldateien, geprüft beim Download und erneut bei jedem Laden. Es läuft unter Ihrem Benutzer, braucht kein root und öffnet keinen eingehenden Port. Der Code ist offen; Sie müssen uns nicht glauben. Auto-Pause hält es aus dem Weg, sobald Sie am Rechner arbeiten. Ehrlich zur aktuellen Grenze: Die Engine läuft als unprivilegierter Kindprozess auf localhost, noch nicht in einer Syscall-Sandbox.
Wie und wann werde ich bezahlt?
80% des Umsatzes jedes Tokens, den Ihre Maschine liefert. Monatliche SEPA-Auszahlung ab €50, abgewickelt über Stripe (das auch die Identitätsprüfung übernimmt). Ihr Dashboard zeigt Live-Verdienste, gestützt auf Quittungen.
Was, wenn mein Internet oder PC langsam ist?
mahout benchmarkt Ihre Maschine, und das Netzwerk routet nur Arbeit, die sie wirklich bewältigen kann — kleinere Modelle auf kleineren Rigs. Langsame Uplinks bedienen Batch-Jobs statt Live-Chat. Alles wird gemessen, nichts versprochen, was Ihre Hardware nicht kann.
Wird AMD wirklich voll unterstützt?
Ja — gleiche Funktionen, gleiche Stufen, gleiche Vergütung wie bei NVIDIA. Aktuell laufen alle Karten über einen Vulkan-Build von llama.cpp, der AMD, NVIDIA und Intel gleichermaßen bedient; native ROCm- und CUDA-Builds sind ein Performance-Schritt in Arbeit, keine Voraussetzung. Unsere eigene Flotte enthält RX 6900 XT und RX 7900 XTX, der AMD-Pfad wird also täglich benutzt.
Sind meine Prompt-Daten privat?
Prompts und Antworten leben nur im RAM, werden nie geloggt und nie fürs Training verwendet. Die EU-souveräne Stufe erzwingt zusätzlich Maschinen ausschließlich in der EU, serverseitig geprüft. Ein Standard-DPA ist für Unternehmen verfügbar.
Warum nur Open-Source-Modelle?
Offene Gewichte machen einen verteilten Pool erst möglich — jeder kann prüfen, was läuft, und niemand kann die Modelle wegnehmen. Sie machen es auch günstig: keine Lizenzmarge, nur Hardware und Strom.
Lesen, bevor Sie uns vertrauen
Was auf einem Host-Rechner läuft, was eine GPU wirklich einbringt, wohin Prompts gehen und wie eine Anfrage eine Karte findet. Klar geschrieben — auch das, was noch offen ist.
one model, every card: how a 27b runs on 8 gb
Qwen3.8 27B ships in five builds, from Q5_K_M on a 24 GB card down to IQ2_XXS on 8 GB. Why we split models from builds, what quantization actually costs, and how a quantized KV cache doubled our context overnight.
Artikel lesen →we stopped projecting your earnings and started measuring them
Most GPU marketplaces advertise what a card could earn. Our dashboard shows what yours measured, and refuses to show a number until it has one. Here is why that choice cost us a nicer-looking page and was still right.
Artikel lesen →prices should not need an engineer
Our price book used to be a file in a repository, which meant changing a price meant a deploy. It is now a dashboard control with guard rails that refuse an incoherent price — and the file is still the fallback you can return to.
Artikel lesen →Wissensdatenbank
Kurze Antworten auf die Fragen, die wirklich gestellt werden.
- What actually runs on your machine
- Which model can my GPU serve?
- What your GPU actually earns
- Security and privacy: what we do, and what we don't
Bereit einzutauchen?
Entwickler: kostenlose Startguthaben für kleine Modelle. Hosts: mahout installieren — Ihre GPU verdient an jedem servierten Token.
API-Zugang erhalten Meine GPU verbindenEin Konto für beide Seiten. Anmeldung per E-Mail oder Google — ohne Passwort. De Buck Technologies, Belgien.