modelos de ia abiertos.
pool de gpu distribuido.
Una API compatible con OpenAI. Modelos open source. Servidos por un pool verificado de GPU por toda Europa — desde PCs gaming hasta datacenters. Los desarrolladores pagan menos. Los dueños de hardware cobran por cada token que sirven sus máquinas.
Cómo funciona ElephantPool
Los desarrolladores traen peticiones. Los dueños de hardware traen GPU. Nuestro planificador, verificador y raíles de pago están en medio — y se llevan el 20%, solo cuando fluyen tokens.
Los desarrolladores llaman a la API
Cambia tu URL base, conserva tu código: un endpoint compatible con OpenAI para Llama, Qwen, DeepSeek, gpt-oss. Paga por token, créditos prepagados, sin suscripción.
El pool la sirve
El planificador enruta cada petición a la mejor máquina verificada — por velocidad, precio, reputación y (si lo eliges) residencia solo en la UE. Cada trabajo produce un recibo criptográfico.
Los dueños cobran
El 80% de los ingresos de cada token va a la máquina que lo sirvió. Pago mensual por SEPA vía Stripe. Cobras por trabajo realizado — nada que comprar, nada que bloquear.
El reparto es público y se aplica a cada trabajo de la red.
Modelos y precios
Los últimos modelos abiertos, precios transparentes por token, en euros. El nivel Soberano UE enruta solo a máquinas situadas en la UE, verificadas por nosotros y no declaradas por ellas — y aun así cuesta menos que cualquier nube soberana.
| Modelo | Estándar € / M tokens entrada · salida |
Soberano UE € / M tokens entrada · salida |
Otros EE. UU. más barato · soberano UE |
|---|---|---|---|
| Llama 3.1 8B 8B dense · 128K |
€0.03 · €0.06 | €0.05 · €0.10 | US $0.02 · $0.04 DeepInfraEU — |
| Qwen3.8 27B 27B dense · 262K · Apache-2.0 · new |
€0.25 · €1.50 | €0.35 · €2.00 | US $0.40 · $3.00 ChutesEU — |
| Gemma 4 26B-A4B 26B MoE · 256K · Apache-2.0 |
€0.06 · €0.25 | €0.10 · €0.35 | US $0.07 · $0.34 DeepInfraEU — |
| Llama 3.3 70B 70B dense · 128K |
€0.30 · €0.50 | €0.35 · €0.55 | US $0.10 · $0.32 DeepInfraEU €0.65 · €0.65 IONOS |
| gpt-oss-120b 117B MoE · 131K · Apache-2.0 |
€0.06 · €0.30 | €0.10 · €0.45 | US $0.03 · $0.17 CoreWeaveEU €0.08 · €0.40 OVHcloud |
| DeepSeek V4-Flash 304B MoE · 1M · MIT |
€0.15 · €0.35 | €0.25 · €0.55 | US $0.08 · $0.18 DeepInfraEU €0.40 · €0.80 Scaleway |
| MiniMax M3 427B MoE · 1M · community license |
€0.25 · €1.00 | €0.35 · €1.30 | US $0.28 · $1.10 DeepInfraEU — |
| GLM-5.2 753B MoE · 1M · MIT |
€0.45 · €1.40 | €0.60 · €1.80 | US $0.48 · $1.49 NovitaEU €1.80 · €5.50 Scaleway |
| Qwen3.5 397B-A17B 397B MoE · 262K · Apache-2.0 |
€0.40 · €2.50 | €0.50 · €3.00 | US $0.30 · $1.93 DigitalOceanEU €0.60 · €3.60 Scaleway/OVH |
Precios objetivo de lanzamiento. Nivel batch: −50%. Precios de competidores según listas públicas, agosto de 2026. Créditos iniciales gratis en modelos pequeños para los primeros usuarios.
Todos los modelos del catálogo son de pesos abiertos (licencias Apache-2.0, MIT o Llama/comunitarias — enlazadas por modelo en la API). Los gigantes multi-nodo (Qwen3.8 2.4T, Kimi K3, DeepSeek V4-Pro) están en la hoja de ruta, no en el catálogo de lanzamiento.
Sustituto directo
/v1/chat/completions compatible con OpenAI, streaming incluido. Cambia una URL base y ya estás en el pool.
RGPD por construcción
Los prompts nunca tocan un disco, nunca se usan para entrenamiento, y el nivel Soberano UE nunca sale de máquinas que hemos situado en la UE. DPA disponible.
Enrutado inteligente, ahorro inteligente
Elige un modelo — o elige auto y deja que el router envíe cada petición al modelo más barato capaz de resolverla. API batch a mitad de precio.
Tu GPU ya tiene trabajo
Instala mahout, nuestro agente open source — llamado así por la persona que guía a un elefante. Evalúa tu máquina, sirve los modelos que puede manejar y hace que cobres por cada token. Soporte completo NVIDIA y AMD, desde el primer día.
RTX 3090 / 3080
RTX 4090 / 5090
RX 7900 XT / XTX
A6000 · A100 · H100
Seguro por diseño
mahout es open source. Solo ejecuta motores firmados en contenedores aislados — pesos de solo lectura, cero salida de red, nunca código de clientes. Sin puertos entrantes en tu router.
Tu máquina, tus reglas
Define ventanas de disponibilidad, límites de potencia, cuota de disco y un precio mínimo. Pausa automática cuando juegas o trabajas. Parada con un clic, siempre.
Cobra por tu trabajo, cada mes
El 80% de cada token que sirve tu máquina, registrado con recibos criptográficos que puedes verificar tú mismo. Pago mensual por SEPA desde €50, procesado por Stripe. Trabajo inicial garantizado en tu primera semana.
¿Cuánto podría ganar tu hardware?
Estimaciones para servicio con batching continuo según nuestra tarifa de lanzamiento, con el 80% de los ingresos por token pagado a ti. Cobras por el trabajo realmente enrutado a tu máquina — esto es una estimación, no una promesa.
Supuestos utilizados:
- Tarifa de lanzamiento, batching continuo
- Tu parte: 80% de los ingresos por token
- Consumo bajo carga por equipo, mostrado modelo a modelo
- La utilización depende de la demanda de la red en tu región
⚠️ Solo estimaciones. Cobras por los tokens que tu hardware sirve realmente; el volumen depende de la demanda de la red, del benchmark de tu máquina, de su disponibilidad y de su reputación. Es el pago por un servicio que prestas — no una inversión ni un producto financiero. An estimate at the utilisation you chose, not a promise of demand. Measured earnings — from a benchmark on your own card — live in your dashboard.
No confíes en nosotros. Verifícanos.
Cómputo verificado
Cada trabajo produce una huella de activación (el esquema TOPLOC — 258 bytes por cada 32 tokens). Una muestra aleatoria de todo el trabajo se reproduce en hardware de confianza. Las máquinas que falsifican trabajo no cobran — y quedan expulsadas.
Recibos públicos
Los recibos firmados de los trabajos se agrupan en un árbol de Merkle y se anclan en una blockchain pública cada 10 minutos. Cualquier host o cliente puede probar de forma independiente qué se sirvió, cuándo y cuánto se debía.
Open source, documentación abierta
El agente mahout es open source y auditable. Nuestra arquitectura, economía y diseño de verificación están publicados: lee el whitepaper y la especificación técnica.
Europeos, por elección
Operado desde Bélgica por De Buck Technologies. Nivel Soberano UE con enrutado forzado solo en la UE, retención cero y un DPA estándar — a aproximadamente la mitad del precio de las nubes soberanas.
Un reparto público: 80 / 20
El 80% de los ingresos por token para la máquina que hizo el trabajo, el 20% para la red. Sin márgenes ocultos, sin hardware de la casa colándose en igualdad de condiciones.
Hecho para crecer
A largo plazo, la capacidad inactiva del pool entrena modelos abiertos de forma colectiva — la red que sirve la IA también la mejora, a la vista de todos. Esa hoja de ruta también es pública.
Preguntas frecuentes
¿Es seguro para mi PC?
mahout solo ejecuta artefactos fijados y verificados por suma de control: una versión concreta del motor y archivos de modelo concretos, verificados al descargarlos y de nuevo en cada carga. Se ejecuta con tu usuario, no necesita root y no abre ningún puerto entrante. Es código abierto, así que no tienes que creernos. La pausa automática se aparta en cuanto usas el equipo. Siendo honestos con el límite actual: el motor corre como proceso hijo sin privilegios en localhost, todavía no dentro de un sandbox de llamadas al sistema.
¿Cómo y cuándo cobro?
El 80% de los ingresos de cada token que sirve tu máquina. Pago mensual por SEPA desde €50, procesado por Stripe (que también gestiona la verificación de identidad). Tu panel muestra ganancias en vivo, respaldadas por recibos.
¿Y si mi internet o mi PC son lentos?
mahout evalúa tu máquina y la red solo le enruta trabajo que realmente puede manejar — modelos más pequeños en equipos más modestos. Las conexiones lentas sirven trabajos batch en lugar de chat en vivo. Todo se mide; no se promete nada que tu hardware no pueda hacer.
¿AMD está realmente soportado al 100%?
Sí — mismas funciones, mismos niveles, misma retribución que NVIDIA. Hoy todas las tarjetas pasan por una compilación Vulkan de llama.cpp, que sirve igual a AMD, NVIDIA e Intel; las compilaciones nativas ROCm y CUDA son una mejora de rendimiento en curso, no un requisito. Nuestra propia flota incluye RX 6900 XT y RX 7900 XTX, así que la vía AMD se usa a diario.
¿Mis prompts son privados?
Los prompts y las respuestas viven solo en RAM, nunca se registran y nunca se usan para entrenamiento. El nivel Soberano UE impone además máquinas solo en la UE, verificadas por nosotros. Hay un DPA estándar disponible para empresas.
¿Por qué solo modelos open source?
Los pesos abiertos son lo que hace posible un pool distribuido — cualquiera puede verificar qué se está ejecutando y nadie puede quitarte los modelos. También son lo que lo hace barato: sin margen de licencias, solo hardware y electricidad.
Léelo antes de confiar en nosotros
Qué se ejecuta en una máquina anfitriona, cuánto gana realmente una GPU, adónde van los prompts y cómo una petición encuentra una tarjeta. En lenguaje claro, incluso lo que aún está en curso.
one model, every card: how a 27b runs on 8 gb
Qwen3.8 27B ships in five builds, from Q5_K_M on a 24 GB card down to IQ2_XXS on 8 GB. Why we split models from builds, what quantization actually costs, and how a quantized KV cache doubled our context overnight.
Leer el artículo →we stopped projecting your earnings and started measuring them
Most GPU marketplaces advertise what a card could earn. Our dashboard shows what yours measured, and refuses to show a number until it has one. Here is why that choice cost us a nicer-looking page and was still right.
Leer el artículo →prices should not need an engineer
Our price book used to be a file in a repository, which meant changing a price meant a deploy. It is now a dashboard control with guard rails that refuse an incoherent price — and the file is still the fallback you can return to.
Leer el artículo →Base de conocimiento
Respuestas breves a las preguntas que de verdad nos hacen.
- What actually runs on your machine
- Which model can my GPU serve?
- What your GPU actually earns
- Security and privacy: what we do, and what we don't
Leer el código
El agente que se ejecuta en las máquinas anfitrionas es de código abierto.
Pon a trabajar tu GPU →¿Listo para sumergirte?
Desarrolladores: créditos iniciales gratis en modelos pequeños. Hosts: instala mahout y tu GPU gana con cada token servido.
Consigue acceso a la API Conectar mi GPUUna sola cuenta para ambos lados. Accede con tu correo o Google — sin contraseña. De Buck Technologies, Bélgica.