modèles d'ia ouverts.
pool de gpu distribué.
Une API compatible OpenAI. Des modèles open source. Servis par un pool de GPU vérifiés à travers l'Europe — du PC gamer au datacenter. Les développeurs paient moins. Les propriétaires de matériel sont payés pour chaque token servi par leurs machines.
Comment fonctionne ElephantPool
Les développeurs apportent les requêtes. Les propriétaires de matériel apportent les GPU. Notre orchestrateur, notre vérificateur et nos rails de paiement font le lien — et prennent 20%, uniquement quand des tokens circulent.
Les développeurs appellent l'API
Changez votre URL de base, gardez votre code : un endpoint compatible OpenAI pour Llama, Qwen, DeepSeek, gpt-oss. Paiement au token, crédits prépayés, sans abonnement.
Le pool sert la requête
L'orchestrateur route chaque requête vers la meilleure machine vérifiée — selon la vitesse, le prix, la réputation et (si vous le choisissez) une résidence UE uniquement. Chaque job produit un reçu cryptographique.
Les propriétaires sont payés
80% des revenus de chaque token vont à la machine qui l'a servi. Versement SEPA mensuel via Stripe. Payé pour le travail effectué — rien à acheter, rien à immobiliser.
La répartition est publique et s'applique à chaque job du réseau.
Modèles & tarifs
Les derniers modèles ouverts, une tarification transparente au token, en euros. Le niveau Souverain UE route uniquement vers des machines situées dans l'UE, vérifiées par nous et non déclarées par elles — tout en restant moins cher que chaque cloud souverain.
| Modèle | Standard € / M tokens entrée · sortie |
Souverain UE € / M tokens entrée · sortie |
Ailleurs US le moins cher · souverain UE |
|---|---|---|---|
| Llama 3.1 8B 8B dense · 128K |
€0.03 · €0.06 | €0.05 · €0.10 | US $0.02 · $0.04 DeepInfraEU — |
| Qwen3.8 27B 27B dense · 262K · Apache-2.0 · new |
€0.25 · €1.50 | €0.35 · €2.00 | US $0.40 · $3.00 ChutesEU — |
| Gemma 4 26B-A4B 26B MoE · 256K · Apache-2.0 |
€0.06 · €0.25 | €0.10 · €0.35 | US $0.07 · $0.34 DeepInfraEU — |
| Llama 3.3 70B 70B dense · 128K |
€0.30 · €0.50 | €0.35 · €0.55 | US $0.10 · $0.32 DeepInfraEU €0.65 · €0.65 IONOS |
| gpt-oss-120b 117B MoE · 131K · Apache-2.0 |
€0.06 · €0.30 | €0.10 · €0.45 | US $0.03 · $0.17 CoreWeaveEU €0.08 · €0.40 OVHcloud |
| DeepSeek V4-Flash 304B MoE · 1M · MIT |
€0.15 · €0.35 | €0.25 · €0.55 | US $0.08 · $0.18 DeepInfraEU €0.40 · €0.80 Scaleway |
| MiniMax M3 427B MoE · 1M · community license |
€0.25 · €1.00 | €0.35 · €1.30 | US $0.28 · $1.10 DeepInfraEU — |
| GLM-5.2 753B MoE · 1M · MIT |
€0.45 · €1.40 | €0.60 · €1.80 | US $0.48 · $1.49 NovitaEU €1.80 · €5.50 Scaleway |
| Qwen3.5 397B-A17B 397B MoE · 262K · Apache-2.0 |
€0.40 · €2.50 | €0.50 · €3.00 | US $0.30 · $1.93 DigitalOceanEU €0.60 · €3.60 Scaleway/OVH |
Tarifs cibles au lancement. Niveau batch : −50%. Prix des concurrents issus des grilles tarifaires publiques, août 2026. Crédits de démarrage gratuits sur les petits modèles pour les premiers utilisateurs.
Tous les modèles du catalogue sont open-weight (licences Apache-2.0, MIT ou Llama/communautaires — liées par modèle dans l'API). Les géants multi-nœuds (Qwen3.8 2.4T, Kimi K3, DeepSeek V4-Pro) sont sur la feuille de route, pas dans le catalogue de lancement.
Remplacement immédiat
/v1/chat/completions compatible OpenAI, streaming inclus. Changez une URL de base et vous êtes sur le pool.
RGPD par construction
Les prompts ne touchent jamais un disque, ne servent jamais à l'entraînement, et le niveau Souverain UE ne quitte jamais des machines que nous avons localisées dans l'UE. DPA disponible.
Routage intelligent, économies intelligentes
Choisissez un modèle — ou choisissez auto et laissez le routeur envoyer chaque requête au modèle le moins cher capable de la traiter. API batch à moitié prix.
Votre GPU a désormais un emploi
Installez mahout, notre agent open source — nommé d'après la personne qui guide un éléphant. Il évalue votre machine, sert les modèles qu'elle peut gérer et vous rémunère pour chaque token. Support complet NVIDIA et AMD, dès le premier jour.
RTX 3090 / 3080
RTX 4090 / 5090
RX 7900 XT / XTX
A6000 · A100 · H100
Sûr par conception
mahout est open source. Il n'exécute que des moteurs signés dans des conteneurs isolés — poids en lecture seule, zéro sortie réseau, jamais de code client. Aucun port entrant sur votre routeur.
Votre machine, vos règles
Définissez des fenêtres de disponibilité, des limites de puissance, un quota disque et un prix plancher. Pause automatique quand vous jouez ou travaillez. Arrêt en un clic, à tout moment.
Payé pour le travail, chaque mois
80% de chaque token servi par votre machine, tracé par des reçus cryptographiques que vous pouvez vérifier vous-même. Versement SEPA mensuel dès €50, traité par Stripe. Travail de démarrage garanti dès votre première semaine.
Combien votre matériel pourrait-il gagner ?
Estimations pour un service en batch continu selon notre grille tarifaire de lancement, avec 80% des revenus des tokens qui vous sont versés. Vous êtes payé pour le travail réellement routé vers votre machine — c'est une estimation, pas une promesse.
Hypothèses utilisées :
- Grille tarifaire de lancement, batching continu
- Votre part : 80% des revenus des tokens
- Consommation en charge par rig affichée modèle par modèle
- L'utilisation dépend de la demande du réseau dans votre région
⚠️ Estimations uniquement. Vous êtes payé pour les tokens que votre matériel sert réellement ; le volume dépend de la demande du réseau, du benchmark de votre machine, de sa disponibilité et de sa réputation. C'est la rémunération d'un service que vous fournissez — ni un investissement, ni un produit financier. An estimate at the utilisation you chose, not a promise of demand. Measured earnings — from a benchmark on your own card — live in your dashboard.
Ne nous croyez pas sur parole. Vérifiez.
Calcul vérifié
Chaque job produit une empreinte d'activation (le schéma TOPLOC — 258 octets par 32 tokens). Un échantillon aléatoire de tout le travail est rejoué sur du matériel de confiance. Les machines qui falsifient du travail ne sont pas payées — et sont bannies.
Reçus publics
Les reçus de jobs signés sont regroupés dans un arbre de Merkle et ancrés sur une blockchain publique toutes les 10 minutes. Tout hôte ou client peut prouver de façon indépendante ce qui a été servi, quand, et ce qui était dû.
Open source, docs ouvertes
L'agent mahout est open source et auditable. Notre architecture, notre modèle économique et notre design de vérification sont publiés : lisez le whitepaper et la spécification technique.
Européen, par choix
Opéré depuis la Belgique par De Buck Technologies. Niveau Souverain UE avec routage imposé UE uniquement, zéro rétention et un DPA standard — à environ la moitié du prix des clouds souverains.
Une répartition publique : 80 / 20
80% des revenus des tokens à la machine qui a fait le travail, 20% au réseau. Pas de marges cachées, pas de matériel maison qui double la file à conditions égales.
Conçu pour se renforcer
À long terme, la capacité inutilisée du pool entraîne collectivement des modèles ouverts — le réseau qui sert l'IA l'améliore aussi, au grand jour. Cette feuille de route est publique elle aussi.
Questions fréquentes
Est-ce sûr pour mon PC ?
mahout n'exécute que des artefacts épinglés et vérifiés par empreinte — une version précise du moteur et des fichiers de modèle précis, vérifiés pendant le téléchargement puis à chaque chargement. Il tourne sous votre compte, sans root, et n'ouvre aucun port entrant. Le code est ouvert : vous n'avez pas à nous croire sur parole. La pause automatique s'efface dès que vous utilisez la machine. Pour être franc sur la limite actuelle : le moteur tourne comme processus enfant non privilégié lié à localhost, pas encore dans un bac à sable d'appels système.
Comment et quand suis-je payé ?
80% des revenus de chaque token servi par votre machine. Versement SEPA mensuel dès €50, traité par Stripe (qui gère aussi la vérification d'identité). Votre tableau de bord affiche des gains en direct, adossés à des reçus.
Et si mon internet ou mon PC est lent ?
mahout évalue votre machine et le réseau ne lui route que du travail qu'elle peut réellement gérer — des modèles plus petits sur des rigs plus modestes. Les connexions lentes servent des jobs batch plutôt que du chat en direct. Tout est mesuré ; rien n'est promis au-delà de ce que votre matériel peut faire.
AMD est-il vraiment entièrement supporté ?
Oui — mêmes fonctions, mêmes paliers, même rémunération que NVIDIA. Aujourd'hui toutes les cartes passent par un build Vulkan de llama.cpp, qui sert AMD, NVIDIA et Intel indifféremment ; les builds natifs ROCm et CUDA sont un gain de performance en cours, pas un prérequis. Notre propre flotte comprend des RX 6900 XT et RX 7900 XTX : le chemin AMD est éprouvé quotidiennement.
Mes prompts restent-ils privés ?
Les prompts et les réponses ne vivent qu'en RAM, ne sont jamais journalisés et ne sont jamais utilisés pour l'entraînement. Le niveau Souverain UE impose en plus des machines situées dans l'UE, vérifiées côté serveur. Un DPA standard est disponible pour les entreprises.
Pourquoi uniquement des modèles open source ?
Les poids ouverts sont ce qui rend un pool distribué possible — chacun peut vérifier ce qui tourne, et personne ne peut retirer les modèles. C'est aussi ce qui les rend bon marché : pas de marge de licence, juste du matériel et de l'électricité.
À lire avant de nous faire confiance
Ce qui tourne sur une machine hôte, ce qu'un GPU rapporte réellement, où vont les prompts, et comment une requête trouve une carte. Écrit simplement, y compris ce qui reste en chantier.
one model, every card: how a 27b runs on 8 gb
Qwen3.8 27B ships in five builds, from Q5_K_M on a 24 GB card down to IQ2_XXS on 8 GB. Why we split models from builds, what quantization actually costs, and how a quantized KV cache doubled our context overnight.
Lire l'article →we stopped projecting your earnings and started measuring them
Most GPU marketplaces advertise what a card could earn. Our dashboard shows what yours measured, and refuses to show a number until it has one. Here is why that choice cost us a nicer-looking page and was still right.
Lire l'article →prices should not need an engineer
Our price book used to be a file in a repository, which meant changing a price meant a deploy. It is now a dashboard control with guard rails that refuse an incoherent price — and the file is still the fallback you can return to.
Lire l'article →Base de connaissances
Des réponses courtes aux questions que l'on nous pose vraiment.
- What actually runs on your machine
- Which model can my GPU serve?
- What your GPU actually earns
- Security and privacy: what we do, and what we don't
Prêt à plonger ?
Développeurs : crédits de démarrage gratuits sur les petits modèles. Hôtes : installez mahout et votre GPU gagne sur chaque token servi.
Obtenir l'accès API Connecter mon GPUUn seul compte pour les deux côtés. Connexion par e-mail ou Google — sans mot de passe. De Buck Technologies, Belgique.