Le réseau européen d'inférence IA

modèles d'ia ouverts.
pool de gpu distribué.

Une API compatible OpenAI. Des modèles open source. Servis par un pool de GPU vérifiés à travers l'Europe — du PC gamer au datacenter. Les développeurs paient moins. Les propriétaires de matériel sont payés pour chaque token servi par leurs machines.

Compatible OpenAI Option Souverain UE Support complet NVIDIA & AMD
ElephantPool — the distributed AI inference network
80% Des revenus des tokens → propriétaires du matériel
~½ prix vs clouds souverains UE (classe 70B)
100% Modèles open source et open-weight
0 Verrouillage, pour développeurs comme propriétaires
Un pool, deux faces

Comment fonctionne ElephantPool

Les développeurs apportent les requêtes. Les propriétaires de matériel apportent les GPU. Notre orchestrateur, notre vérificateur et nos rails de paiement font le lien — et prennent 20%, uniquement quand des tokens circulent.

1

Les développeurs appellent l'API

Changez votre URL de base, gardez votre code : un endpoint compatible OpenAI pour Llama, Qwen, DeepSeek, gpt-oss. Paiement au token, crédits prépayés, sans abonnement.

2

Le pool sert la requête

L'orchestrateur route chaque requête vers la meilleure machine vérifiée — selon la vitesse, le prix, la réputation et (si vous le choisissez) une résidence UE uniquement. Chaque job produit un reçu cryptographique.

3

Les propriétaires sont payés

80% des revenus de chaque token vont à la machine qui l'a servi. Versement SEPA mensuel via Stripe. Payé pour le travail effectué — rien à acheter, rien à immobiliser.

80%
20%
→ Propriétaires de matériel, par token servi → Réseau : orchestration, vérification, paiements

La répartition est publique et s'applique à chaque job du réseau.

Pour les développeurs

Modèles & tarifs

Les derniers modèles ouverts, une tarification transparente au token, en euros. Le niveau Souverain UE route uniquement vers des machines situées dans l'UE, vérifiées par nous et non déclarées par elles — tout en restant moins cher que chaque cloud souverain.

Modèle Standard
€ / M tokens entrée · sortie
Souverain UE
€ / M tokens entrée · sortie
Ailleurs
US le moins cher · souverain UE
Llama 3.1 8B
8B dense · 128K
€0.03 · €0.06 €0.05 · €0.10 US  $0.02 · $0.04 DeepInfraEU  —
Qwen3.8 27B
27B dense · 262K · Apache-2.0 · new
€0.25 · €1.50 €0.35 · €2.00 US  $0.40 · $3.00 ChutesEU  —
Gemma 4 26B-A4B
26B MoE · 256K · Apache-2.0
€0.06 · €0.25 €0.10 · €0.35 US  $0.07 · $0.34 DeepInfraEU  —
Llama 3.3 70B
70B dense · 128K
€0.30 · €0.50 €0.35 · €0.55 US  $0.10 · $0.32 DeepInfraEU  €0.65 · €0.65 IONOS
gpt-oss-120b
117B MoE · 131K · Apache-2.0
€0.06 · €0.30 €0.10 · €0.45 US  $0.03 · $0.17 CoreWeaveEU  €0.08 · €0.40 OVHcloud
DeepSeek V4-Flash
304B MoE · 1M · MIT
€0.15 · €0.35 €0.25 · €0.55 US  $0.08 · $0.18 DeepInfraEU  €0.40 · €0.80 Scaleway
MiniMax M3
427B MoE · 1M · community license
€0.25 · €1.00 €0.35 · €1.30 US  $0.28 · $1.10 DeepInfraEU  —
GLM-5.2
753B MoE · 1M · MIT
€0.45 · €1.40 €0.60 · €1.80 US  $0.48 · $1.49 NovitaEU  €1.80 · €5.50 Scaleway
Qwen3.5 397B-A17B
397B MoE · 262K · Apache-2.0
€0.40 · €2.50 €0.50 · €3.00 US  $0.30 · $1.93 DigitalOceanEU  €0.60 · €3.60 Scaleway/OVH

Tarifs cibles au lancement. Niveau batch : −50%. Prix des concurrents issus des grilles tarifaires publiques, août 2026. Crédits de démarrage gratuits sur les petits modèles pour les premiers utilisateurs.

Tous les modèles du catalogue sont open-weight (licences Apache-2.0, MIT ou Llama/communautaires — liées par modèle dans l'API). Les géants multi-nœuds (Qwen3.8 2.4T, Kimi K3, DeepSeek V4-Pro) sont sur la feuille de route, pas dans le catalogue de lancement.

Remplacement immédiat

/v1/chat/completions compatible OpenAI, streaming inclus. Changez une URL de base et vous êtes sur le pool.

RGPD par construction

Les prompts ne touchent jamais un disque, ne servent jamais à l'entraînement, et le niveau Souverain UE ne quitte jamais des machines que nous avons localisées dans l'UE. DPA disponible.

Routage intelligent, économies intelligentes

Choisissez un modèle — ou choisissez auto et laissez le routeur envoyer chaque requête au modèle le moins cher capable de la traiter. API batch à moitié prix.

Pour les propriétaires de matériel

Votre GPU a désormais un emploi

Installez mahout, notre agent open source — nommé d'après la personne qui guide un éléphant. Il évalue votre machine, sert les modèles qu'elle peut gérer et vous rémunère pour chaque token. Support complet NVIDIA et AMD, dès le premier jour.

Entrée de gamme

RTX 3090 / 3080

10–24GB de VRAM · sert les modèles 8–32B
est. €60–120/mois brut, bien utilisé · l'électricité est à votre charge
Estimer
Le point idéal

RTX 4090 / 5090

24–32GB de VRAM · sert la classe 32B rapidement
est. €130–290/mois brut, bien utilisé · les rigs bi-cartes servent du 70B
Estimer
AMD de première classe

RX 7900 XT / XTX

20–24GB de VRAM · support complet ROCm & Vulkan
est. €60–110/mois brut, bien utilisé · mêmes fonctionnalités et même rémunération que NVIDIA
Estimer
Pro / datacenter

A6000 · A100 · H100

48–80GB de VRAM · sert du 70B+ en solo
est. €200–700/mois brut par carte, bien utilisé · accès au niveau SLA
Estimer

Sûr par conception

mahout est open source. Il n'exécute que des moteurs signés dans des conteneurs isolés — poids en lecture seule, zéro sortie réseau, jamais de code client. Aucun port entrant sur votre routeur.

Votre machine, vos règles

Définissez des fenêtres de disponibilité, des limites de puissance, un quota disque et un prix plancher. Pause automatique quand vous jouez ou travaillez. Arrêt en un clic, à tout moment.

Payé pour le travail, chaque mois

80% de chaque token servi par votre machine, tracé par des reçus cryptographiques que vous pouvez vérifier vous-même. Versement SEPA mensuel dès €50, traité par Stripe. Travail de démarrage garanti dès votre première semaine.

Estimateur de gains

Combien votre matériel pourrait-il gagner ?

Estimations pour un service en batch continu selon notre grille tarifaire de lancement, avec 80% des revenus des tokens qui vous sont versés. Vous êtes payé pour le travail réellement routé vers votre machine — c'est une estimation, pas une promesse.

Taux de paiement à pleine charge €0.35/hr
Utilisation 50%
Versement mensuel (brut) €128
Votre coût d'électricité −€42
Net mensuel €86
Par an (net) €1,034

Hypothèses utilisées :

  • Grille tarifaire de lancement, batching continu
  • Votre part : 80% des revenus des tokens
  • Consommation en charge par rig affichée modèle par modèle
  • L'utilisation dépend de la demande du réseau dans votre région

⚠️ Estimations uniquement. Vous êtes payé pour les tokens que votre matériel sert réellement ; le volume dépend de la demande du réseau, du benchmark de votre machine, de sa disponibilité et de sa réputation. C'est la rémunération d'un service que vous fournissez — ni un investissement, ni un produit financier. An estimate at the utilisation you chose, not a promise of demand. Measured earnings — from a benchmark on your own card — live in your dashboard.

Crédibilité & transparence

Ne nous croyez pas sur parole. Vérifiez.

Calcul vérifié

Chaque job produit une empreinte d'activation (le schéma TOPLOC — 258 octets par 32 tokens). Un échantillon aléatoire de tout le travail est rejoué sur du matériel de confiance. Les machines qui falsifient du travail ne sont pas payées — et sont bannies.

Reçus publics

Les reçus de jobs signés sont regroupés dans un arbre de Merkle et ancrés sur une blockchain publique toutes les 10 minutes. Tout hôte ou client peut prouver de façon indépendante ce qui a été servi, quand, et ce qui était dû.

Open source, docs ouvertes

L'agent mahout est open source et auditable. Notre architecture, notre modèle économique et notre design de vérification sont publiés : lisez le whitepaper et la spécification technique.

Européen, par choix

Opéré depuis la Belgique par De Buck Technologies. Niveau Souverain UE avec routage imposé UE uniquement, zéro rétention et un DPA standard — à environ la moitié du prix des clouds souverains.

Une répartition publique : 80 / 20

80% des revenus des tokens à la machine qui a fait le travail, 20% au réseau. Pas de marges cachées, pas de matériel maison qui double la file à conditions égales.

Conçu pour se renforcer

À long terme, la capacité inutilisée du pool entraîne collectivement des modèles ouverts — le réseau qui sert l'IA l'améliore aussi, au grand jour. Cette feuille de route est publique elle aussi.

Questions

Questions fréquentes

Est-ce sûr pour mon PC ?

mahout n'exécute que des artefacts épinglés et vérifiés par empreinte — une version précise du moteur et des fichiers de modèle précis, vérifiés pendant le téléchargement puis à chaque chargement. Il tourne sous votre compte, sans root, et n'ouvre aucun port entrant. Le code est ouvert : vous n'avez pas à nous croire sur parole. La pause automatique s'efface dès que vous utilisez la machine. Pour être franc sur la limite actuelle : le moteur tourne comme processus enfant non privilégié lié à localhost, pas encore dans un bac à sable d'appels système.

Comment et quand suis-je payé ?

80% des revenus de chaque token servi par votre machine. Versement SEPA mensuel dès €50, traité par Stripe (qui gère aussi la vérification d'identité). Votre tableau de bord affiche des gains en direct, adossés à des reçus.

Et si mon internet ou mon PC est lent ?

mahout évalue votre machine et le réseau ne lui route que du travail qu'elle peut réellement gérer — des modèles plus petits sur des rigs plus modestes. Les connexions lentes servent des jobs batch plutôt que du chat en direct. Tout est mesuré ; rien n'est promis au-delà de ce que votre matériel peut faire.

AMD est-il vraiment entièrement supporté ?

Oui — mêmes fonctions, mêmes paliers, même rémunération que NVIDIA. Aujourd'hui toutes les cartes passent par un build Vulkan de llama.cpp, qui sert AMD, NVIDIA et Intel indifféremment ; les builds natifs ROCm et CUDA sont un gain de performance en cours, pas un prérequis. Notre propre flotte comprend des RX 6900 XT et RX 7900 XTX : le chemin AMD est éprouvé quotidiennement.

Mes prompts restent-ils privés ?

Les prompts et les réponses ne vivent qu'en RAM, ne sont jamais journalisés et ne sont jamais utilisés pour l'entraînement. Le niveau Souverain UE impose en plus des machines situées dans l'UE, vérifiées côté serveur. Un DPA standard est disponible pour les entreprises.

Pourquoi uniquement des modèles open source ?

Les poids ouverts sont ce qui rend un pool distribué possible — chacun peut vérifier ce qui tourne, et personne ne peut retirer les modèles. C'est aussi ce qui les rend bon marché : pas de marge de licence, juste du matériel et de l'électricité.

Comprendre

À lire avant de nous faire confiance

Ce qui tourne sur une machine hôte, ce qu'un GPU rapporte réellement, où vont les prompts, et comment une requête trouve une carte. Écrit simplement, y compris ce qui reste en chantier.

Prêt à plonger ?

Développeurs : crédits de démarrage gratuits sur les petits modèles. Hôtes : installez mahout et votre GPU gagne sur chaque token servi.

Obtenir l'accès API Connecter mon GPU

Un seul compte pour les deux côtés. Connexion par e-mail ou Google — sans mot de passe. De Buck Technologies, Belgique.