Das europäische Netzwerk für KI-Inferenz

offene ki-modelle.
verteilter gpu-pool.

Eine OpenAI-kompatible API. Open-Source-Modelle. Bereitgestellt von einem verifizierten GPU-Pool quer durch Europa — vom Gaming-PC bis zum Rechenzentrum. Entwickler zahlen weniger. Hardware-Besitzer werden für jeden Token bezahlt, den ihre Maschinen liefern.

OpenAI-kompatibel EU-souveräne Option Voller NVIDIA- & AMD-Support
ElephantPool — the distributed AI inference network
80% Des Token-Umsatzes → Hardware-Besitzer
~½ Preis ggü. souveränen EU-Clouds (70B-Klasse)
100% Open-Source- und Open-Weight-Modelle
0 Lock-in, für Entwickler und Besitzer
Ein Pool, zwei Seiten

So funktioniert ElephantPool

Entwickler bringen Anfragen. Hardware-Besitzer bringen GPUs. Unser Scheduler, unser Verifizierer und unsere Zahlungsschienen sitzen dazwischen — und nehmen 20%, nur wenn Tokens fließen.

1

Entwickler rufen die API auf

Tauschen Sie Ihre Basis-URL, behalten Sie Ihren Code: ein OpenAI-kompatibler Endpoint für Llama, Qwen, DeepSeek, gpt-oss. Bezahlung pro Token, Prepaid-Guthaben, kein Abo.

2

Der Pool bedient sie

Der Scheduler leitet jede Anfrage an die beste verifizierte Maschine — nach Geschwindigkeit, Preis, Reputation und (auf Wunsch) reiner EU-Residenz. Jeder Job erzeugt eine kryptografische Quittung.

3

Besitzer werden bezahlt

80% des Umsatzes jedes Tokens gehen an die Maschine, die ihn geliefert hat. Monatliche SEPA-Auszahlung über Stripe. Bezahlt für geleistete Arbeit — nichts zu kaufen, nichts zu binden.

80%
20%
→ Hardware-Besitzer, pro geliefertem Token → Netzwerk: Scheduling, Verifizierung, Zahlungen

Die Aufteilung ist öffentlich und gilt für jeden Job im Netzwerk.

Für Entwickler

Modelle & Preise

Die neuesten offenen Modelle, transparente Preise pro Token, in Euro. Die EU-souveräne Stufe routet ausschließlich zu Maschinen in der EU, von uns geprüft statt von ihnen behauptet — und unterbietet trotzdem jede souveräne Cloud.

Modell Standard
€ / M Tokens ein · aus
EU-souverän
€ / M Tokens ein · aus
Anderswo
günstigster US · EU-souverän
Llama 3.1 8B
8B dense · 128K
€0.03 · €0.06 €0.05 · €0.10 US  $0.02 · $0.04 DeepInfraEU  —
Qwen3.8 27B
27B dense · 262K · Apache-2.0 · new
€0.25 · €1.50 €0.35 · €2.00 US  $0.40 · $3.00 ChutesEU  —
Gemma 4 26B-A4B
26B MoE · 256K · Apache-2.0
€0.06 · €0.25 €0.10 · €0.35 US  $0.07 · $0.34 DeepInfraEU  —
Llama 3.3 70B
70B dense · 128K
€0.30 · €0.50 €0.35 · €0.55 US  $0.10 · $0.32 DeepInfraEU  €0.65 · €0.65 IONOS
gpt-oss-120b
117B MoE · 131K · Apache-2.0
€0.06 · €0.30 €0.10 · €0.45 US  $0.03 · $0.17 CoreWeaveEU  €0.08 · €0.40 OVHcloud
DeepSeek V4-Flash
304B MoE · 1M · MIT
€0.15 · €0.35 €0.25 · €0.55 US  $0.08 · $0.18 DeepInfraEU  €0.40 · €0.80 Scaleway
MiniMax M3
427B MoE · 1M · community license
€0.25 · €1.00 €0.35 · €1.30 US  $0.28 · $1.10 DeepInfraEU  —
GLM-5.2
753B MoE · 1M · MIT
€0.45 · €1.40 €0.60 · €1.80 US  $0.48 · $1.49 NovitaEU  €1.80 · €5.50 Scaleway
Qwen3.5 397B-A17B
397B MoE · 262K · Apache-2.0
€0.40 · €2.50 €0.50 · €3.00 US  $0.30 · $1.93 DigitalOceanEU  €0.60 · €3.60 Scaleway/OVH

Angestrebte Launch-Preise. Batch-Stufe: −50%. Wettbewerberpreise aus öffentlichen Preislisten, August 2026. Kostenloses Startguthaben auf kleinen Modellen für frühe Nutzer.

Alle Katalogmodelle sind open-weight (Apache-2.0-, MIT- oder Llama-/Community-Lizenzen — pro Modell in der API verlinkt). Multi-Node-Giganten (Qwen3.8 2.4T, Kimi K3, DeepSeek V4-Pro) stehen auf der Roadmap, nicht im Launch-Katalog.

Drop-in-Ersatz

OpenAI-kompatibles /v1/chat/completions, Streaming inklusive. Eine Basis-URL ändern und Sie sind im Pool.

DSGVO by Design

Prompts berühren nie eine Festplatte, werden nie fürs Training verwendet, und die EU-souveräne Stufe verlässt nie Maschinen, die wir in der EU verortet haben. DPA verfügbar.

Smartes Routing, smarte Ersparnis

Wählen Sie ein Modell — oder wählen Sie auto und lassen Sie den Router jede Anfrage an das günstigste Modell schicken, das sie bewältigen kann. Batch-API zum halben Preis.

Für Hardware-Besitzer

Ihre GPU hat jetzt einen festen Job

Installieren Sie mahout, unseren Open-Source-Agenten — benannt nach der Person, die einen Elefanten führt. Er benchmarkt Ihre Maschine, liefert Modelle, die sie bewältigen kann, und sorgt dafür, dass Sie für jeden Token bezahlt werden. Voller NVIDIA- und AMD-Support, vom ersten Tag an.

Einstieg

RTX 3090 / 3080

10–24GB VRAM · liefert 8–32B-Modelle
ca. €60–120/Monat brutto, gut ausgelastet · Strom zahlen Sie
Berechnen
Sweet Spot

RTX 4090 / 5090

24–32GB VRAM · liefert 32B-Klasse schnell
ca. €130–290/Monat brutto, gut ausgelastet · Rigs mit zwei Karten liefern 70B
Berechnen
AMD erstklassig

RX 7900 XT / XTX

20–24GB VRAM · voller ROCm- & Vulkan-Support
ca. €60–110/Monat brutto, gut ausgelastet · gleiche Features & gleiche Bezahlung wie NVIDIA
Berechnen
Pro / Rechenzentrum

A6000 · A100 · H100

48–80GB VRAM · liefert 70B+ allein
ca. €200–700/Monat brutto pro Karte, gut ausgelastet · Zugang zur SLA-Stufe
Berechnen

Sicher by Design

mahout ist Open Source. Es führt nur signierte Engines in sandboxed Containern aus — Gewichte nur lesbar, null Netzwerk-Egress, niemals Client-Code. Keine eingehenden Ports auf Ihrem Router.

Ihre Maschine, Ihre Regeln

Legen Sie Verfügbarkeitsfenster, Leistungslimits, Speicherkontingent und einen Mindestpreis fest. Auto-Pause, wenn Sie spielen oder arbeiten. Stopp mit einem Klick, jederzeit.

Bezahlt für Arbeit, monatlich

80% jedes Tokens, den Ihre Maschine liefert, nachverfolgt durch kryptografische Quittungen, die Sie selbst prüfen können. Monatliche SEPA-Auszahlung ab €50, abgewickelt über Stripe. Garantierte Start-Arbeit in Ihrer ersten Woche.

Verdienst-Rechner

Was könnte Ihre Hardware verdienen?

Schätzungen für kontinuierlich gebatchtes Serving zu unserem Launch-Preisbuch, mit 80% des Token-Umsatzes als Auszahlung an Sie. Sie werden für Arbeit bezahlt, die tatsächlich an Ihre Maschine geroutet wird — das ist eine Schätzung, kein Versprechen.

Auszahlungsrate bei Volllast €0.35/hr
Auslastung 50%
Monatliche Auszahlung (brutto) €128
Ihre Stromkosten −€42
Monatlich netto €86
Pro Jahr (netto) €1,034

Verwendete Annahmen:

  • Launch-Preisbuch, Continuous Batching
  • Ihr Anteil: 80% des Token-Umsatzes
  • Leistungsaufnahme unter Last pro Rig, Modell für Modell ausgewiesen
  • Die Auslastung hängt von der Netzwerk-Nachfrage in Ihrer Region ab

⚠️ Nur Schätzungen. Sie werden für Tokens bezahlt, die Ihre Hardware tatsächlich liefert; das Volumen hängt von der Netzwerk-Nachfrage, dem Benchmark Ihrer Maschine, der Verfügbarkeit und der Reputation ab. Dies ist Bezahlung für eine Leistung, die Sie erbringen — keine Geldanlage, kein Finanzprodukt. An estimate at the utilisation you chose, not a promise of demand. Measured earnings — from a benchmark on your own card — live in your dashboard.

Glaubwürdigkeit & Transparenz

Vertrauen Sie uns nicht. Prüfen Sie uns.

Verifizierte Rechenleistung

Jeder Job erzeugt einen Aktivierungs-Fingerabdruck (das TOPLOC-Schema — 258 Bytes pro 32 Tokens). Eine Zufallsstichprobe aller Arbeit wird auf vertrauenswürdiger Hardware wiederholt. Maschinen, die Arbeit fälschen, werden nicht bezahlt — und werden gesperrt.

Öffentliche Quittungen

Signierte Job-Quittungen werden in einem Merkle-Baum gebündelt und alle 10 Minuten auf einer öffentlichen Blockchain verankert. Jeder Host oder Kunde kann unabhängig beweisen, was wann geliefert wurde und was geschuldet war.

Open Source, offene Doku

Der mahout-Agent ist Open Source und auditierbar. Unsere Architektur, Ökonomie und unser Verifizierungsdesign sind veröffentlicht: Lesen Sie das Whitepaper und die technische Spezifikation.

Europäisch, aus Überzeugung

Betrieben aus Belgien von De Buck Technologies. EU-souveräne Stufe mit erzwungenem EU-only-Routing, null Datenspeicherung und einem Standard-DPA — zu etwa dem halben Preis souveräner Clouds.

Eine öffentliche Aufteilung: 80 / 20

80% des Token-Umsatzes an die Maschine, die die Arbeit geleistet hat, 20% ans Netzwerk. Keine versteckten Spannen, keine hauseigene Hardware, die sich bei gleichen Bedingungen vordrängelt.

Gebaut, um zu wachsen

Langfristig trainiert ungenutzte Pool-Kapazität gemeinsam offene Modelle — das Netzwerk, das KI bereitstellt, verbessert sie auch, und zwar offen. Auch diese Roadmap ist öffentlich.

Fragen

Häufige Fragen

Ist das sicher für meinen PC?

mahout führt ausschließlich fixierte, per Prüfsumme verifizierte Artefakte aus — eine bestimmte Engine-Version und bestimmte Modelldateien, geprüft beim Download und erneut bei jedem Laden. Es läuft unter Ihrem Benutzer, braucht kein root und öffnet keinen eingehenden Port. Der Code ist offen; Sie müssen uns nicht glauben. Auto-Pause hält es aus dem Weg, sobald Sie am Rechner arbeiten. Ehrlich zur aktuellen Grenze: Die Engine läuft als unprivilegierter Kindprozess auf localhost, noch nicht in einer Syscall-Sandbox.

Wie und wann werde ich bezahlt?

80% des Umsatzes jedes Tokens, den Ihre Maschine liefert. Monatliche SEPA-Auszahlung ab €50, abgewickelt über Stripe (das auch die Identitätsprüfung übernimmt). Ihr Dashboard zeigt Live-Verdienste, gestützt auf Quittungen.

Was, wenn mein Internet oder PC langsam ist?

mahout benchmarkt Ihre Maschine, und das Netzwerk routet nur Arbeit, die sie wirklich bewältigen kann — kleinere Modelle auf kleineren Rigs. Langsame Uplinks bedienen Batch-Jobs statt Live-Chat. Alles wird gemessen, nichts versprochen, was Ihre Hardware nicht kann.

Wird AMD wirklich voll unterstützt?

Ja — gleiche Funktionen, gleiche Stufen, gleiche Vergütung wie bei NVIDIA. Aktuell laufen alle Karten über einen Vulkan-Build von llama.cpp, der AMD, NVIDIA und Intel gleichermaßen bedient; native ROCm- und CUDA-Builds sind ein Performance-Schritt in Arbeit, keine Voraussetzung. Unsere eigene Flotte enthält RX 6900 XT und RX 7900 XTX, der AMD-Pfad wird also täglich benutzt.

Sind meine Prompt-Daten privat?

Prompts und Antworten leben nur im RAM, werden nie geloggt und nie fürs Training verwendet. Die EU-souveräne Stufe erzwingt zusätzlich Maschinen ausschließlich in der EU, serverseitig geprüft. Ein Standard-DPA ist für Unternehmen verfügbar.

Warum nur Open-Source-Modelle?

Offene Gewichte machen einen verteilten Pool erst möglich — jeder kann prüfen, was läuft, und niemand kann die Modelle wegnehmen. Sie machen es auch günstig: keine Lizenzmarge, nur Hardware und Strom.

Verstehen

Lesen, bevor Sie uns vertrauen

Was auf einem Host-Rechner läuft, was eine GPU wirklich einbringt, wohin Prompts gehen und wie eine Anfrage eine Karte findet. Klar geschrieben — auch das, was noch offen ist.

Bereit einzutauchen?

Entwickler: kostenlose Startguthaben für kleine Modelle. Hosts: mahout installieren — Ihre GPU verdient an jedem servierten Token.

API-Zugang erhalten Meine GPU verbinden

Ein Konto für beide Seiten. Anmeldung per E-Mail oder Google — ohne Passwort. De Buck Technologies, Belgien.