La rete europea di inferenza IA

modelli di ia aperti.
pool di gpu distribuito.

Una API compatibile OpenAI. Modelli open source. Serviti da un pool verificato di GPU in tutta Europa — dai PC da gaming ai datacenter. Gli sviluppatori pagano meno. I proprietari di hardware vengono pagati per ogni token servito dalle loro macchine.

Compatibile OpenAI Opzione Sovrano UE Supporto completo NVIDIA e AMD
ElephantPool — the distributed AI inference network
80% Dei ricavi dei token → proprietari dell'hardware
~½ prezzo vs cloud sovrani UE (classe 70B)
100% Modelli open source e open-weight
0 Lock-in, per sviluppatori e proprietari
Un pool, due lati

Come funziona ElephantPool

Gli sviluppatori portano le richieste. I proprietari di hardware portano le GPU. Il nostro scheduler, il verificatore e i binari di pagamento stanno nel mezzo — e prendono il 20%, solo quando i token scorrono.

1

Gli sviluppatori chiamano l'API

Cambia il tuo URL base, tieni il tuo codice: un endpoint compatibile OpenAI per Llama, Qwen, DeepSeek, gpt-oss. Paghi per token, crediti prepagati, nessun abbonamento.

2

Il pool la serve

Lo scheduler instrada ogni richiesta verso la migliore macchina verificata — per velocità, prezzo, reputazione e (se lo scegli) residenza solo UE. Ogni job produce una ricevuta crittografica.

3

I proprietari vengono pagati

L'80% dei ricavi di ogni token va alla macchina che l'ha servito. Pagamento mensile SEPA via Stripe. Pagato per il lavoro svolto — niente da comprare, niente da vincolare.

80%
20%
→ Proprietari di hardware, per token servito → Rete: scheduling, verifica, pagamenti

La ripartizione è pubblica e vale per ogni job della rete.

Per chi sviluppa

Modelli e prezzi

Gli ultimi modelli aperti, prezzi trasparenti per token, in euro. Il livello Sovrano UE instrada solo verso macchine situate nell'UE, verificate da noi e non dichiarate da loro — e costa comunque meno di ogni cloud sovrano.

Modello Standard
€ / M token in · out
Sovrano UE
€ / M token in · out
Altrove
US più economico · sovrano UE
Llama 3.1 8B
8B dense · 128K
€0.03 · €0.06 €0.05 · €0.10 US  $0.02 · $0.04 DeepInfraEU  —
Qwen3.8 27B
27B dense · 262K · Apache-2.0 · new
€0.25 · €1.50 €0.35 · €2.00 US  $0.40 · $3.00 ChutesEU  —
Gemma 4 26B-A4B
26B MoE · 256K · Apache-2.0
€0.06 · €0.25 €0.10 · €0.35 US  $0.07 · $0.34 DeepInfraEU  —
Llama 3.3 70B
70B dense · 128K
€0.30 · €0.50 €0.35 · €0.55 US  $0.10 · $0.32 DeepInfraEU  €0.65 · €0.65 IONOS
gpt-oss-120b
117B MoE · 131K · Apache-2.0
€0.06 · €0.30 €0.10 · €0.45 US  $0.03 · $0.17 CoreWeaveEU  €0.08 · €0.40 OVHcloud
DeepSeek V4-Flash
304B MoE · 1M · MIT
€0.15 · €0.35 €0.25 · €0.55 US  $0.08 · $0.18 DeepInfraEU  €0.40 · €0.80 Scaleway
MiniMax M3
427B MoE · 1M · community license
€0.25 · €1.00 €0.35 · €1.30 US  $0.28 · $1.10 DeepInfraEU  —
GLM-5.2
753B MoE · 1M · MIT
€0.45 · €1.40 €0.60 · €1.80 US  $0.48 · $1.49 NovitaEU  €1.80 · €5.50 Scaleway
Qwen3.5 397B-A17B
397B MoE · 262K · Apache-2.0
€0.40 · €2.50 €0.50 · €3.00 US  $0.30 · $1.93 DigitalOceanEU  €0.60 · €3.60 Scaleway/OVH

Prezzi obiettivo al lancio. Livello batch: −50%. Prezzi dei concorrenti dai listini pubblici, agosto 2026. Crediti iniziali gratuiti sui modelli piccoli per i primi utenti.

Tutti i modelli del catalogo sono open-weight (licenze Apache-2.0, MIT o Llama/community — collegate per modello nell'API). I giganti multi-nodo (Qwen3.8 2.4T, Kimi K3, DeepSeek V4-Pro) sono nella roadmap, non nel catalogo di lancio.

Sostituzione immediata

/v1/chat/completions compatibile OpenAI, streaming incluso. Cambia un URL base e sei sul pool.

GDPR per costruzione

I prompt non toccano mai un disco, non vengono mai usati per l'addestramento, e il livello Sovrano UE non lascia mai macchine che abbiamo collocato nell'UE. DPA disponibile.

Routing intelligente, risparmi intelligenti

Scegli un modello — oppure scegli auto e lascia che il router invii ogni richiesta al modello più economico in grado di gestirla. API batch a metà prezzo.

Per i proprietari di hardware

La tua GPU adesso ha un lavoro vero

Installa mahout, il nostro agente open source — dal nome della persona che guida un elefante. Fa il benchmark della tua macchina, serve i modelli che può gestire e ti fa ricevere il pagamento per ogni token. Supporto completo NVIDIA e AMD, dal primo giorno.

Base

RTX 3090 / 3080

10–24GB di VRAM · serve modelli 8–32B
stima €60–120/mese lordo, ben utilizzato · l'elettricità la paghi tu
Stima
Punto ideale

RTX 4090 / 5090

24–32GB di VRAM · serve la classe 32B velocemente
stima €130–290/mese lordo, ben utilizzato · i rig a doppia scheda servono 70B
Stima
AMD di prima classe

RX 7900 XT / XTX

20–24GB di VRAM · supporto completo ROCm e Vulkan
stima €60–110/mese lordo, ben utilizzato · stesse funzioni e stessa paga di NVIDIA
Stima
Pro / datacenter

A6000 · A100 · H100

48–80GB di VRAM · serve 70B+ da sola
stima €200–700/mese lordo per scheda, ben utilizzato · accesso al livello SLA
Stima

Sicuro per progettazione

mahout è open source. Esegue solo engine firmati in container sandbox — pesi in sola lettura, zero traffico in uscita, mai codice dei clienti. Nessuna porta in ingresso sul tuo router.

La tua macchina, le tue regole

Imposta finestre di disponibilità, limiti di potenza, quota disco e un prezzo minimo. Pausa automatica quando giochi o lavori. Stop con un clic, sempre.

Pagato per il lavoro, ogni mese

L'80% di ogni token servito dalla tua macchina, tracciato con ricevute crittografiche che puoi verificare tu stesso. Pagamento mensile SEPA da €50, elaborato da Stripe. Lavoro iniziale garantito nella tua prima settimana.

Stimatore di guadagni

Quanto potrebbe guadagnare il tuo hardware?

Stime per un serving con batching continuo al nostro listino di lancio, con l'80% dei ricavi dei token pagato a te. Vieni pagato per il lavoro effettivamente instradato alla tua macchina — è una stima, non una promessa.

Tariffa di pagamento a pieno carico €0.35/hr
Utilizzo 50%
Pagamento mensile (lordo) €128
Il tuo costo dell'elettricità −€42
Netto mensile €86
All'anno (netto) €1,034

Ipotesi utilizzate:

  • Listino di lancio, batching continuo
  • La tua quota: 80% dei ricavi dei token
  • Consumo sotto carico per rig mostrato modello per modello
  • L'utilizzo dipende dalla domanda della rete nella tua regione

⚠️ Solo stime. Vieni pagato per i token che il tuo hardware serve davvero; il volume dipende dalla domanda della rete, dal benchmark della tua macchina, dall'uptime e dalla reputazione. È il pagamento per un servizio che fornisci — non un investimento, non un prodotto finanziario. An estimate at the utilisation you chose, not a promise of demand. Measured earnings — from a benchmark on your own card — live in your dashboard.

Credibilità e trasparenza

Non fidarti di noi. Verificaci.

Calcolo verificato

Ogni job produce un'impronta di attivazione (lo schema TOPLOC — 258 byte ogni 32 token). Un campione casuale di tutto il lavoro viene rieseguito su hardware fidato. Le macchine che falsificano il lavoro non vengono pagate — e vengono bandite.

Ricevute pubbliche

Le ricevute firmate dei job vengono raggruppate in un albero di Merkle e ancorate su una blockchain pubblica ogni 10 minuti. Qualsiasi host o cliente può dimostrare in modo indipendente cosa è stato servito, quando, e quanto era dovuto.

Open source, documentazione aperta

L'agente mahout è open source e verificabile. La nostra architettura, l'economia e il design della verifica sono pubblicati: leggi il whitepaper e la specifica tecnica.

Europei, per scelta

Operato dal Belgio da De Buck Technologies. Livello Sovrano UE con instradamento imposto solo UE, zero conservazione dei dati e un DPA standard — a circa metà del prezzo dei cloud sovrani.

Una ripartizione pubblica: 80 / 20

L'80% dei ricavi dei token alla macchina che ha fatto il lavoro, il 20% alla rete. Nessun margine nascosto, nessun hardware della casa che salta la fila a parità di condizioni.

Costruito per crescere

Nel lungo periodo, la capacità inattiva del pool addestra collettivamente modelli aperti — la rete che serve l'IA la migliora anche, alla luce del sole. Anche quella roadmap è pubblica.

Domande

Domande frequenti

È sicuro per il mio PC?

mahout esegue solo artefatti fissati e verificati tramite checksum — una specifica release del motore e specifici file di modello, verificati durante il download e di nuovo a ogni caricamento. Gira con il tuo utente, non richiede root e non apre alcuna porta in ingresso. È open source: non devi crederci sulla parola. La pausa automatica si toglie di mezzo appena usi la macchina. Per essere onesti sul limite attuale: il motore gira come processo figlio non privilegiato su localhost, non ancora in una sandbox di system call.

Come e quando vengo pagato?

L'80% dei ricavi di ogni token servito dalla tua macchina. Pagamento mensile SEPA da €50, elaborato da Stripe (che gestisce anche la verifica dell'identità). La tua dashboard mostra guadagni in tempo reale, supportati da ricevute.

E se la mia connessione o il mio PC sono lenti?

mahout fa il benchmark della tua macchina e la rete instrada solo lavoro che può davvero gestire — modelli più piccoli su rig più piccoli. Le connessioni lente servono job batch invece della chat in tempo reale. Tutto viene misurato, non viene promesso nulla che il tuo hardware non possa fare.

AMD è davvero supportato al 100%?

Sì — stesse funzioni, stessi livelli, stesso compenso di NVIDIA. Oggi tutte le schede passano da una build Vulkan di llama.cpp, che serve allo stesso modo AMD, NVIDIA e Intel; le build native ROCm e CUDA sono un miglioramento di prestazioni in corso, non un prerequisito. La nostra flotta include RX 6900 XT e RX 7900 XTX: il percorso AMD è collaudato ogni giorno.

I miei prompt restano privati?

Prompt e completamenti vivono solo in RAM, non vengono mai registrati e non vengono mai usati per l'addestramento. Il livello Sovrano UE impone inoltre macchine solo nell'UE, verificate lato server. Un DPA standard è disponibile per le aziende.

Perché solo modelli open source?

I pesi aperti sono ciò che rende possibile un pool distribuito — chiunque può verificare cosa gira, e nessuno può portarti via i modelli. Sono anche ciò che lo rende economico: nessun margine di licenza, solo hardware ed elettricità.

Approfondire

Da leggere prima di fidarti di noi

Cosa gira su una macchina host, quanto rende davvero una GPU, dove finiscono i prompt e come una richiesta trova una scheda. In parole chiare, comprese le parti ancora in lavorazione.

Pronto a tuffarti?

Sviluppatori: crediti iniziali gratuiti sui modelli piccoli. Host: installa mahout e la tua GPU guadagna su ogni token servito.

Ottieni l'accesso API Collega la mia GPU

Un solo account per entrambi i lati. Accedi con e-mail o Google — senza password. De Buck Technologies, Belgio.