La red europea de inferencia de IA

modelos de ia abiertos.
pool de gpu distribuido.

Una API compatible con OpenAI. Modelos open source. Servidos por un pool verificado de GPU por toda Europa — desde PCs gaming hasta datacenters. Los desarrolladores pagan menos. Los dueños de hardware cobran por cada token que sirven sus máquinas.

Compatible con OpenAI Opción Soberano UE Soporte completo NVIDIA y AMD
ElephantPool — the distributed AI inference network
80% De los ingresos por token → dueños del hardware
~½ precio vs nubes soberanas de la UE (clase 70B)
100% Modelos open source y de pesos abiertos
0 Lock-in, para desarrolladores y dueños
Un pool, dos lados

Cómo funciona ElephantPool

Los desarrolladores traen peticiones. Los dueños de hardware traen GPU. Nuestro planificador, verificador y raíles de pago están en medio — y se llevan el 20%, solo cuando fluyen tokens.

1

Los desarrolladores llaman a la API

Cambia tu URL base, conserva tu código: un endpoint compatible con OpenAI para Llama, Qwen, DeepSeek, gpt-oss. Paga por token, créditos prepagados, sin suscripción.

2

El pool la sirve

El planificador enruta cada petición a la mejor máquina verificada — por velocidad, precio, reputación y (si lo eliges) residencia solo en la UE. Cada trabajo produce un recibo criptográfico.

3

Los dueños cobran

El 80% de los ingresos de cada token va a la máquina que lo sirvió. Pago mensual por SEPA vía Stripe. Cobras por trabajo realizado — nada que comprar, nada que bloquear.

80%
20%
→ Dueños de hardware, por token servido → Red: planificación, verificación, pagos

El reparto es público y se aplica a cada trabajo de la red.

Para desarrolladores

Modelos y precios

Los últimos modelos abiertos, precios transparentes por token, en euros. El nivel Soberano UE enruta solo a máquinas situadas en la UE, verificadas por nosotros y no declaradas por ellas — y aun así cuesta menos que cualquier nube soberana.

Modelo Estándar
€ / M tokens entrada · salida
Soberano UE
€ / M tokens entrada · salida
Otros
EE. UU. más barato · soberano UE
Llama 3.1 8B
8B dense · 128K
€0.03 · €0.06 €0.05 · €0.10 US  $0.02 · $0.04 DeepInfraEU  —
Qwen3.8 27B
27B dense · 262K · Apache-2.0 · new
€0.25 · €1.50 €0.35 · €2.00 US  $0.40 · $3.00 ChutesEU  —
Gemma 4 26B-A4B
26B MoE · 256K · Apache-2.0
€0.06 · €0.25 €0.10 · €0.35 US  $0.07 · $0.34 DeepInfraEU  —
Llama 3.3 70B
70B dense · 128K
€0.30 · €0.50 €0.35 · €0.55 US  $0.10 · $0.32 DeepInfraEU  €0.65 · €0.65 IONOS
gpt-oss-120b
117B MoE · 131K · Apache-2.0
€0.06 · €0.30 €0.10 · €0.45 US  $0.03 · $0.17 CoreWeaveEU  €0.08 · €0.40 OVHcloud
DeepSeek V4-Flash
304B MoE · 1M · MIT
€0.15 · €0.35 €0.25 · €0.55 US  $0.08 · $0.18 DeepInfraEU  €0.40 · €0.80 Scaleway
MiniMax M3
427B MoE · 1M · community license
€0.25 · €1.00 €0.35 · €1.30 US  $0.28 · $1.10 DeepInfraEU  —
GLM-5.2
753B MoE · 1M · MIT
€0.45 · €1.40 €0.60 · €1.80 US  $0.48 · $1.49 NovitaEU  €1.80 · €5.50 Scaleway
Qwen3.5 397B-A17B
397B MoE · 262K · Apache-2.0
€0.40 · €2.50 €0.50 · €3.00 US  $0.30 · $1.93 DigitalOceanEU  €0.60 · €3.60 Scaleway/OVH

Precios objetivo de lanzamiento. Nivel batch: −50%. Precios de competidores según listas públicas, agosto de 2026. Créditos iniciales gratis en modelos pequeños para los primeros usuarios.

Todos los modelos del catálogo son de pesos abiertos (licencias Apache-2.0, MIT o Llama/comunitarias — enlazadas por modelo en la API). Los gigantes multi-nodo (Qwen3.8 2.4T, Kimi K3, DeepSeek V4-Pro) están en la hoja de ruta, no en el catálogo de lanzamiento.

Sustituto directo

/v1/chat/completions compatible con OpenAI, streaming incluido. Cambia una URL base y ya estás en el pool.

RGPD por construcción

Los prompts nunca tocan un disco, nunca se usan para entrenamiento, y el nivel Soberano UE nunca sale de máquinas que hemos situado en la UE. DPA disponible.

Enrutado inteligente, ahorro inteligente

Elige un modelo — o elige auto y deja que el router envíe cada petición al modelo más barato capaz de resolverla. API batch a mitad de precio.

Para dueños de hardware

Tu GPU ya tiene trabajo

Instala mahout, nuestro agente open source — llamado así por la persona que guía a un elefante. Evalúa tu máquina, sirve los modelos que puede manejar y hace que cobres por cada token. Soporte completo NVIDIA y AMD, desde el primer día.

Básica

RTX 3090 / 3080

10–24GB de VRAM · sirve modelos de 8–32B
est. €60–120/mes bruto, con buena utilización · la electricidad la pagas tú
Estimar
Punto óptimo

RTX 4090 / 5090

24–32GB de VRAM · sirve clase 32B rápido
est. €130–290/mes bruto, con buena utilización · los equipos de dos tarjetas sirven 70B
Estimar
AMD de primera

RX 7900 XT / XTX

20–24GB de VRAM · soporte completo de ROCm y Vulkan
est. €60–110/mes bruto, con buena utilización · mismas funciones y misma paga que NVIDIA
Estimar
Pro / datacenter

A6000 · A100 · H100

48–80GB de VRAM · sirve 70B+ en solitario
est. €200–700/mes bruto por tarjeta, con buena utilización · acceso al nivel con SLA
Estimar

Seguro por diseño

mahout es open source. Solo ejecuta motores firmados en contenedores aislados — pesos de solo lectura, cero salida de red, nunca código de clientes. Sin puertos entrantes en tu router.

Tu máquina, tus reglas

Define ventanas de disponibilidad, límites de potencia, cuota de disco y un precio mínimo. Pausa automática cuando juegas o trabajas. Parada con un clic, siempre.

Cobra por tu trabajo, cada mes

El 80% de cada token que sirve tu máquina, registrado con recibos criptográficos que puedes verificar tú mismo. Pago mensual por SEPA desde €50, procesado por Stripe. Trabajo inicial garantizado en tu primera semana.

Estimador de ganancias

¿Cuánto podría ganar tu hardware?

Estimaciones para servicio con batching continuo según nuestra tarifa de lanzamiento, con el 80% de los ingresos por token pagado a ti. Cobras por el trabajo realmente enrutado a tu máquina — esto es una estimación, no una promesa.

Tarifa de pago a plena carga €0.35/hr
Utilización 50%
Pago mensual (bruto) €128
Tu coste de electricidad −€42
Neto mensual €86
Al año (neto) €1,034

Supuestos utilizados:

  • Tarifa de lanzamiento, batching continuo
  • Tu parte: 80% de los ingresos por token
  • Consumo bajo carga por equipo, mostrado modelo a modelo
  • La utilización depende de la demanda de la red en tu región

⚠️ Solo estimaciones. Cobras por los tokens que tu hardware sirve realmente; el volumen depende de la demanda de la red, del benchmark de tu máquina, de su disponibilidad y de su reputación. Es el pago por un servicio que prestas — no una inversión ni un producto financiero. An estimate at the utilisation you chose, not a promise of demand. Measured earnings — from a benchmark on your own card — live in your dashboard.

Credibilidad y transparencia

No confíes en nosotros. Verifícanos.

Cómputo verificado

Cada trabajo produce una huella de activación (el esquema TOPLOC — 258 bytes por cada 32 tokens). Una muestra aleatoria de todo el trabajo se reproduce en hardware de confianza. Las máquinas que falsifican trabajo no cobran — y quedan expulsadas.

Recibos públicos

Los recibos firmados de los trabajos se agrupan en un árbol de Merkle y se anclan en una blockchain pública cada 10 minutos. Cualquier host o cliente puede probar de forma independiente qué se sirvió, cuándo y cuánto se debía.

Open source, documentación abierta

El agente mahout es open source y auditable. Nuestra arquitectura, economía y diseño de verificación están publicados: lee el whitepaper y la especificación técnica.

Europeos, por elección

Operado desde Bélgica por De Buck Technologies. Nivel Soberano UE con enrutado forzado solo en la UE, retención cero y un DPA estándar — a aproximadamente la mitad del precio de las nubes soberanas.

Un reparto público: 80 / 20

El 80% de los ingresos por token para la máquina que hizo el trabajo, el 20% para la red. Sin márgenes ocultos, sin hardware de la casa colándose en igualdad de condiciones.

Hecho para crecer

A largo plazo, la capacidad inactiva del pool entrena modelos abiertos de forma colectiva — la red que sirve la IA también la mejora, a la vista de todos. Esa hoja de ruta también es pública.

Preguntas

Preguntas frecuentes

¿Es seguro para mi PC?

mahout solo ejecuta artefactos fijados y verificados por suma de control: una versión concreta del motor y archivos de modelo concretos, verificados al descargarlos y de nuevo en cada carga. Se ejecuta con tu usuario, no necesita root y no abre ningún puerto entrante. Es código abierto, así que no tienes que creernos. La pausa automática se aparta en cuanto usas el equipo. Siendo honestos con el límite actual: el motor corre como proceso hijo sin privilegios en localhost, todavía no dentro de un sandbox de llamadas al sistema.

¿Cómo y cuándo cobro?

El 80% de los ingresos de cada token que sirve tu máquina. Pago mensual por SEPA desde €50, procesado por Stripe (que también gestiona la verificación de identidad). Tu panel muestra ganancias en vivo, respaldadas por recibos.

¿Y si mi internet o mi PC son lentos?

mahout evalúa tu máquina y la red solo le enruta trabajo que realmente puede manejar — modelos más pequeños en equipos más modestos. Las conexiones lentas sirven trabajos batch en lugar de chat en vivo. Todo se mide; no se promete nada que tu hardware no pueda hacer.

¿AMD está realmente soportado al 100%?

Sí — mismas funciones, mismos niveles, misma retribución que NVIDIA. Hoy todas las tarjetas pasan por una compilación Vulkan de llama.cpp, que sirve igual a AMD, NVIDIA e Intel; las compilaciones nativas ROCm y CUDA son una mejora de rendimiento en curso, no un requisito. Nuestra propia flota incluye RX 6900 XT y RX 7900 XTX, así que la vía AMD se usa a diario.

¿Mis prompts son privados?

Los prompts y las respuestas viven solo en RAM, nunca se registran y nunca se usan para entrenamiento. El nivel Soberano UE impone además máquinas solo en la UE, verificadas por nosotros. Hay un DPA estándar disponible para empresas.

¿Por qué solo modelos open source?

Los pesos abiertos son lo que hace posible un pool distribuido — cualquiera puede verificar qué se está ejecutando y nadie puede quitarte los modelos. También son lo que lo hace barato: sin margen de licencias, solo hardware y electricidad.

Aprender

Léelo antes de confiar en nosotros

Qué se ejecuta en una máquina anfitriona, cuánto gana realmente una GPU, adónde van los prompts y cómo una petición encuentra una tarjeta. En lenguaje claro, incluso lo que aún está en curso.

Documentos

La arquitectura, la economía y el protocolo, al completo.

Catálogo de modelos →

Leer el código

El agente que se ejecuta en las máquinas anfitrionas es de código abierto.

Pon a trabajar tu GPU →

¿Listo para sumergirte?

Desarrolladores: créditos iniciales gratis en modelos pequeños. Hosts: instala mahout y tu GPU gana con cada token servido.

Consigue acceso a la API Conectar mi GPU

Una sola cuenta para ambos lados. Accede con tu correo o Google — sin contraseña. De Buck Technologies, Bélgica.