{"id":231,"date":"2026-07-31T22:40:53","date_gmt":"2026-07-31T22:40:53","guid":{"rendered":"https:\/\/hoge.gg\/it\/inferenza-decentralizzata-agenti-ai-2026\/"},"modified":"2026-07-31T22:40:53","modified_gmt":"2026-07-31T22:40:53","slug":"inferenza-decentralizzata-agenti-ai-2026","status":"publish","type":"post","link":"https:\/\/hoge.gg\/it\/inferenza-decentralizzata-agenti-ai-2026\/","title":{"rendered":"Inferenza decentralizzata: perch\u00e9 ora la comprano gli agenti AI"},"content":{"rendered":"<h2 class='wp-block-heading'>Il vero collo di bottiglia dell&#8217;AI non \u00e8 l&#8217;addestramento, \u00e8 l&#8217;inferenza<\/h2><p class=\"wp-block-paragraph\">Nel primo trimestre del 2026 CoreWeave, il fornitore di capacit\u00e0 GPU su cui si appoggia gran parte dei laboratori AI occidentali, ha chiuso con un fatturato di 2,078 miliardi di dollari, in crescita del 112% su base annua, e un portafoglio ordini arrivato a quasi 100 miliardi di dollari, quasi quattro volte quello di dodici mesi prima. Durante la <a href='https:\/\/www.fool.com\/earnings\/call-transcripts\/2026\/05\/08\/coreweave-crwv-q1-2026-earnings-transcript\/'>call trimestrale con gli analisti<\/a>, il CEO Michael Intrator ha riassunto cos\u00ec il problema del settore: \u00abIl vincolo nell&#8217;AI non \u00e8 pi\u00f9 se le aziende e i laboratori vogliono adottarla. \u00c8 quanto velocemente si possa consegnare capacit\u00e0 cloud AI affidabile e ad alte prestazioni.\u00bb<\/p><p class=\"wp-block-paragraph\">\u00c8 la fotografia di un mercato dominato da poche aziende con capitale sufficiente a prenotare centinaia di migliaia di GPU Nvidia con anni di anticipo. Da tempo una parte della crypto scommette su un modello alternativo: reti dove chiunque abbia una GPU inutilizzata, da un data center dismesso a un PC da gaming, pu\u00f2 affittarla a chi deve far girare un modello, con un token a coordinare domanda e offerta. Anche sommando tutte le categorie AI-crypto tracciate dagli aggregatori di mercato, dagli agenti autonomi ai marketplace di calcolo, il settore resta piccolo se confrontato con la spesa in infrastruttura dei singoli hyperscaler.<\/p><p class=\"wp-block-paragraph\">La domanda utile nel 2026, per\u00f2, non \u00e8 pi\u00f9 se questa infrastruttura funzioni tecnicamente, bens\u00ec chi la sta effettivamente pagando. E la risposta che emerge dai dati non \u00e8 lo sviluppatore che confronta i prezzi su una dashboard: \u00e8, sempre pi\u00f9 spesso, un software autonomo che non ha mai avuto una carta di credito. In questo approfondimento ricostruiamo le principali reti di inferenza decentralizzata attive a fine luglio 2026, i loro numeri pi\u00f9 recenti e, soprattutto, chi le sta usando davvero.<\/p><h2 class='wp-block-heading'>Inferenza decentralizzata, in breve: cosa cambia rispetto al training<\/h2><p class=\"wp-block-paragraph\">Addestrare un modello linguistico di grandi dimensioni richiede migliaia di GPU sincronizzate sulla stessa rete ad altissima velocit\u00e0 per settimane o mesi: un compito che tollera pochissimo la latenza o l&#8217;eterogeneit\u00e0 dell&#8217;hardware, e per questo resta appannaggio di pochi cluster centralizzati, o di protocolli specializzati come Gensyn, pensati apposta per il training distribuito. L&#8217;inferenza, cio\u00e8 l&#8217;esecuzione del modello gi\u00e0 addestrato per rispondere a un prompt, \u00e8 un problema diverso: ogni richiesta \u00e8 indipendente dalle altre, non serve sincronizzare migliaia di chip, e un singolo server con una manciata di GPU pu\u00f2 servire utenti in tutto il mondo.<\/p><p class=\"wp-block-paragraph\">Questa asimmetria \u00e8 la ragione strutturale per cui l&#8217;inferenza, non il training, \u00e8 il segmento in cui le reti decentralizzate hanno probabilit\u00e0 realistiche di ritagliarsi uno spazio. Su Render Network, per fare un esempio concreto, i carichi di lavoro legati all&#8217;AI sono passati da meno del 10% dell&#8217;attivit\u00e0 della rete nel 2024 al 35-40% nel 2026, proprio perch\u00e9 l&#8217;inferenza non richiede i cluster sincronizzati e massicci di cui invece ha bisogno il training.<\/p><h2 class='wp-block-heading'>Le tre famiglie di reti (e perch\u00e9 non sono la stessa cosa)<\/h2><p class=\"wp-block-paragraph\">Nel 2026 \u00abinferenza decentralizzata\u00bb \u00e8 un&#8217;etichetta che copre almeno tre architetture diverse, spesso confuse tra loro nelle conversazioni superficiali:<\/p><ul class='wp-block-list'><li>Subnet a incentivi: reti come Bittensor, in cui validatori giudicano la qualit\u00e0 dell&#8217;output prodotto dai partecipanti (i \u00abminer\u00bb) e distribuiscono ricompense di conseguenza; qui si paga la qualit\u00e0 del risultato, non l&#8217;ora di GPU.<\/li><li>Marketplace di GPU in affitto: reti come Akash, io.net, Render e Nosana, dove chi possiede hardware lo mette all&#8217;asta o lo affitta a chi deve far girare un carico di lavoro; il modello economico \u00e8 quello di un affitto a breve termine per il calcolo, non un giudizio sulla qualit\u00e0 dell&#8217;output.<\/li><li>Coprocessor on-chain: reti come Ritual, dove l&#8217;inferenza diventa una primitiva richiamabile direttamente da uno smart contract, con l&#8217;obiettivo di rendere un output AI verificabile e utilizzabile on-chain quanto il risultato di un&#8217;operazione aritmetica.<\/li><\/ul><p class=\"wp-block-paragraph\">Confonderle porta a conclusioni sbagliate: paragonare il prezzo per ora di una GPU su Akash al costo di una subnet su Bittensor \u00e8 come paragonare il prezzo di un server AWS a quello di un abbonamento a un modello gi\u00e0 ottimizzato. Nelle prossime sezioni le trattiamo separatamente prima di arrivare alla domanda pi\u00f9 interessante: chi le sta comprando davvero.<\/p><h2 class='wp-block-heading'>Bittensor e il consenso di Yuma: pagare la qualit\u00e0, non l&#8217;ora di GPU<\/h2><p class=\"wp-block-paragraph\">Bittensor, lanciato nel 2019 da Jacob Steeves e Ala Shaabana, organizza la rete in oltre 100 subnet indipendenti, ciascuna dedicata a un compito specifico: generazione di testo, generazione di immagini, storage decentralizzato e altro ancora. All&#8217;interno di ogni subnet i miner producono output, i validatori li valutano con il cosiddetto consenso di Yuma e la ricompensa in token viene distribuita in base al punteggio ottenuto, non al tempo di calcolo impiegato. Il modello dTAO consente inoltre a ogni subnet di avere un proprio sottotoken (chiamato \u00abalpha\u00bb) il cui prezzo riflette la domanda specifica per quel servizio.<\/p><p class=\"wp-block-paragraph\">Per l&#8217;inferenza in particolare, le subnet pi\u00f9 rilevanti sono Chutes, dedicata all&#8217;inferenza serverless, e Targon, gestita da Manifold Labs. A fine luglio 2026 TAO, il token della rete, tratta intorno a <a href='https:\/\/www.coingecko.com\/en\/coins\/bittensor\/eur'>167,59 euro<\/a>, per una capitalizzazione di circa 1,61 miliardi di euro e la 42\u00aa posizione per capitalizzazione tra tutti gli asset digitali tracciati, in calo di circa il 6,7% nell&#8217;ultimo mese. Sull&#8217;architettura delle subnet e sulla governance della rete abbiamo scritto <a href='https:\/\/hoge.gg\/it\/bittensor-ai-crypto-spiegato\/'>un approfondimento dedicato<\/a>, utile per chi vuole entrare pi\u00f9 nel dettaglio del funzionamento tecnico.<\/p><h2 class='wp-block-heading'>I marketplace GPU: Akash, io.net, Render e Nosana<\/h2><p class=\"wp-block-paragraph\">Akash Network, fondata nel 2018 da Greg Osuri e Adam Bozanich, funziona con un&#8217;asta inversa: chi vuole calcolo scrive un manifesto tecnico (SDL) con i requisiti, i provider fanno offerte al ribasso, il tenant sceglie senza essere obbligato a prendere l&#8217;offerta pi\u00f9 economica. Il marketplace GPU \u00e8 arrivato con l&#8217;aggiornamento Supercloud nell&#8217;agosto 2023, e AkashML, il layer di inferenza gestita della rete, ospita oggi modelli aperti come Llama 3.3 e DeepSeek V3. A fine luglio 2026 AKT tratta intorno a <a href='https:\/\/www.coingecko.com\/en\/coins\/akash-network\/eur'>0,38 euro<\/a>, per una capitalizzazione di circa 112 milioni di euro, in calo di oltre il 27% nell&#8217;ultimo mese.<\/p><p class=\"wp-block-paragraph\">Render Network \u00e8 il progetto pi\u00f9 anziano del gruppo: nasce nel 2008 come OTOY, l&#8217;azienda di Jules Urbach dietro il motore di rendering GPU OctaneRender lanciato nel 2012, prima di estendersi al rendering distribuito su blockchain e poi all&#8217;inferenza AI vera e propria. Il token RENDER, migrato quasi interamente da Ethereum a Solana, capitalizza oggi circa <a href='https:\/\/www.coingecko.com\/en\/coins\/render\/eur'>616 milioni di euro<\/a>, con il prezzo intorno a 1,19 euro. io.net, costruita su Solana e fondata da Ahmad Shadid, aggrega invece GPU da data center, ex miner di criptovalute e cluster consumer, un&#8217;idea nata dalle esigenze di calcolo del trading quantitativo del suo fondatore; il token <a href='https:\/\/www.coingecko.com\/en\/coins\/io-net'>IO capitalizza circa 47,5 milioni di euro<\/a>. Nosana, anch&#8217;essa su Solana, punta su sviluppatori indipendenti che cercano inferenza a basso costo, con NOS intorno ai 23 milioni di euro di capitalizzazione.<\/p><p class=\"wp-block-paragraph\">Akash \u00e8 anche al centro della notizia pi\u00f9 importante del 2026 per questo gruppo di reti: l&#8217;addio alla propria chain Cosmos, mai realmente ospitata su Cosmos Hub, in favore di un modello di sicurezza condivisa ancora da scegliere tra una quindicina di chain candidate, Solana inclusa. La motivazione tecnica \u00e8 precisa: ad aprile 2026 Cosmos SDK ha cambiato la licenza del proprio modulo Enterprise da Apache-2.0 a una licenza che vieta l&#8217;uso commerciale senza un accordo separato, una mossa che <a href='https:\/\/x.com\/gregosuri\/status\/2044528963515789696'>Osuri ha definito \u00abostile\u00bb su X<\/a>. Ne abbiamo ricostruito i dettagli, inclusa la proposta di governance AEP-79, in <a href='https:\/\/hoge.gg\/it\/akash-network-lascia-cosmos-gpu-decentralizzate\/'>un articolo dedicato<\/a>.<\/p><figure class='wp-block-table'><table><thead><tr><th>Rete<\/th><th>Modello<\/th><th>Blockchain<\/th><th>Token<\/th><th>Prezzo (fine luglio 2026)<\/th><th>Capitalizzazione<\/th><\/tr><\/thead><tbody><tr><td>Bittensor<\/td><td>Subnet a incentivi (consenso di Yuma)<\/td><td>Chain proprietaria (Substrate)<\/td><td>TAO<\/td><td>~167,59 \u20ac<\/td><td>~1,61 mld \u20ac<\/td><\/tr><tr><td>Akash Network<\/td><td>Marketplace GPU (asta inversa)<\/td><td>In transizione da Cosmos (AEP-79)<\/td><td>AKT<\/td><td>~0,38 \u20ac<\/td><td>~112 mln \u20ac<\/td><\/tr><tr><td>io.net<\/td><td>Aggregatore GPU (data center, ex mining, consumer)<\/td><td>Solana<\/td><td>IO<\/td><td>~0,13 \u20ac<\/td><td>~47,5 mln \u20ac<\/td><\/tr><tr><td>Render Network<\/td><td>Marketplace GPU (rendering 3D + inferenza AI)<\/td><td>Solana<\/td><td>RENDER<\/td><td>~1,19 \u20ac<\/td><td>~616 mln \u20ac<\/td><\/tr><tr><td>Nosana<\/td><td>Marketplace GPU per sviluppatori indipendenti<\/td><td>Solana<\/td><td>NOS<\/td><td>~0,25 \u20ac<\/td><td>~23 mln \u20ac<\/td><\/tr><tr><td>Ritual<\/td><td>Coprocessor on-chain per smart contract<\/td><td>Ritual Chain (in sviluppo)<\/td><td>Non ancora quotato<\/td><td>n\/d<\/td><td>n\/d<\/td><\/tr><\/tbody><\/table><\/figure><h2 class='wp-block-heading'>Ritual: quando l&#8217;inferenza diventa una primitiva on-chain<\/h2><p class=\"wp-block-paragraph\">Ritual, fondata a New York nel 2023 da Niraj Pant, per sei anni in Polychain Capital, e Akilesh Potti, con una serie A da 25 milioni di dollari guidata da Archetype (tra i partecipanti anche Balaji Srinivasan, Accel e Robot Ventures), propone un&#8217;architettura in due stadi: Infernet, un livello oracolare che permette agli smart contract di chiamare modelli AI esterni, e Ritual Chain, che punta a portare l&#8217;inferenza dentro il protocollo stesso come precompilato nativo. L&#8217;obiettivo \u00e8 rendere una chiamata a un modello AI verificabile e componibile quanto qualsiasi altra operazione on-chain, combinando trusted execution environment e prove a conoscenza zero a seconda del livello di garanzia richiesto.<\/p><p class=\"wp-block-paragraph\">A differenza dei marketplace GPU, che vendono capacit\u00e0 di calcolo grezza, Ritual vende un primitivo: uno smart contract che ha bisogno di un giudizio, per esempio valutare un&#8217;immagine, generare un testo o stimare un rischio, pu\u00f2 chiamare Infernet come chiamerebbe un oracolo di prezzo. \u00c8 un approccio pi\u00f9 vicino a ci\u00f2 che serve a un&#8217;applicazione DeFi o a un agente on-chain che a uno sviluppatore in cerca semplicemente di GPU a basso costo. Il progetto resta nella fase di sviluppo del protocollo: a fine luglio 2026 non ha ancora un token quotato.<\/p><h2 class='wp-block-heading'>Il vero acquirente del 2026 non \u00e8 uno sviluppatore, \u00e8 un agente<\/h2><p class=\"wp-block-paragraph\">Qui arriva il punto pi\u00f9 interessante dell&#8217;intero settore. Per anni la tesi di vendita delle reti di inferenza decentralizzata \u00e8 stata rivolta agli sviluppatori umani: prezzi pi\u00f9 bassi di AWS o Google Cloud, nessun vendor lock-in, accesso a GPU altrimenti introvabili durante la carenza globale. I numeri della sezione precedente, per\u00f2, raccontano una migrazione di massa degli sviluppatori che semplicemente non c&#8217;\u00e8 stata: Akash ha perso undici provider attivi in un anno, lo vediamo nel dettaglio pi\u00f9 avanti, e i ricavi da leasing tracciati in modo indipendente sono calati, non cresciuti. Il segmento di domanda che invece sta effettivamente crescendo \u00e8 un altro: agenti AI autonomi, cio\u00e8 software con un proprio wallet che pianificano ed eseguono azioni senza intervento umano a ogni passaggio.<\/p><p class=\"wp-block-paragraph\">La ragione \u00e8 quasi banale una volta enunciata: un agente non pu\u00f2 aprire un conto AWS, inserire una carta di credito e accettare termini di servizio pensati per un essere umano identificabile. Ha invece bisogno di pagare per singola chiamata, senza account, senza verifica d&#8217;identit\u00e0, senza il rischio che un singolo fornitore centralizzato sospenda l&#8217;accesso con un clic. \u00c8 esattamente il tipo di accesso permissionless che una rete come Akash o Bittensor pu\u00f2 offrire nativamente. Non \u00e8 teoria: <a href='https:\/\/akash.network\/blog\/akashml-managed-ai-inference-on-the-decentralized-supercloud\/'>Akash cita tra i clienti<\/a> che gi\u00e0 eseguono carichi di lavoro in produzione su AkashML nomi come Venice, ElizaOS, Morpheus e Gensyn, e un tutorial pubblicato dal team di Venice mostra passo dopo passo come distribuire un agente ElizaOS su Akash usando l&#8217;API di Venice per l&#8217;inferenza in meno di dieci minuti.<\/p><p class=\"wp-block-paragraph\">Morpheus, in particolare, ha reso il proprio router di inferenza disponibile come template pronto su Akash, cos\u00ec che chiunque possa diventare un compute provider per la rete Morpheus in pochi minuti. \u00c8 un cambio di prospettiva importante: il cliente non \u00e8 pi\u00f9 uno sviluppatore che clicca su una dashboard, ma un altro protocollo AI che integra l&#8217;inferenza decentralizzata come componente infrastrutturale, spesso in modo completamente automatizzato. Il riflesso si vede anche nella finanza decentralizzata, dove una quota crescente dei nuovi protocolli lanciati nel 2026 integra almeno un agente autonomo per gestire strategie, arbitraggi o ribilanciamenti: ognuno di questi agenti \u00e8 un potenziale cliente ricorrente per le reti descritte in questo pezzo, non solo per il calcolo ma anche per la resistenza alla censura che offrono rispetto a un&#8217;API centralizzata.<\/p><h2 class='wp-block-heading'>x402, AP2 e la corsa ai pagamenti agentici<\/h2><p class=\"wp-block-paragraph\">Se gli agenti sono il nuovo acquirente, serve un modo per farli pagare senza intervento umano. Il candidato pi\u00f9 maturo si chiama x402, un protocollo che resuscita il codice di stato HTTP 402 \u00abPayment Required\u00bb, previsto dagli architetti del web fin dagli anni novanta ma mai davvero implementato perch\u00e9 le commissioni delle carte rendevano impraticabili i micropagamenti. Con x402 un server risponde a una richiesta con un 402 e le istruzioni di pagamento, l&#8217;agente firma una transazione in stablecoin, quasi sempre USDC, e riprova la richiesta, senza abbonamenti n\u00e9 moduli da compilare.<\/p><p class=\"wp-block-paragraph\">Il 14 luglio 2026 la <a href='https:\/\/www.coindesk.com\/business\/2026\/07\/16\/ai-payments-have-a-new-open-standards-body-its-aim-is-to-reinvent-the-internet'>Linux Foundation ha reso operativa la x402 Foundation<\/a>, con quattordici membri fondatori tra cui Visa, Mastercard, American Express, Stripe, Adyen, Fiserv, Shopify, Google, Amazon Web Services, Cloudflare, Ripple, Circle, MoonPay e Solana Foundation. Alla presidenza siede Alin Dragos, senior manager dei pagamenti in AWS, mentre tra i membri premier compare Denelle Dixon, CEO della Stellar Development Foundation, che ha spiegato cos\u00ec la posta in gioco: \u00abNon vuoi essere in un giardino recintato quando si tratta di soldi\u00bb, aggiungendo che l&#8217;obiettivo \u00e8 costruire \u00abun sistema finanziario globale, pubblico e davvero aperto, a cui tutti possano avere accesso\u00bb.<\/p><p class=\"wp-block-paragraph\">I numeri, letti con attenzione, raccontano un&#8217;adozione reale ma ancora immatura, ed \u00e8 qui che vale la pena essere scettici verso le narrative troppo pulite. Secondo <a href='https:\/\/www.chainalysis.com\/blog\/x402-agentic-payments-adoption\/'>un&#8217;analisi di Chainalysis<\/a>, le transazioni cumulative su x402 sulla sola rete Base hanno superato i 100 milioni entro il primo trimestre 2026, partendo da quasi zero a met\u00e0 2025; ma una parte consistente dell&#8217;impennata nel quarto trimestre 2025 \u00e8 stata trainata da un memecoin, PING, non da genuino commercio tra agenti. Il segnale pi\u00f9 incoraggiante \u00e8 nella composizione del traffico: le transazioni sopra il dollaro sono passate dal 49% al 95% del volume nello stesso periodo, segno che il traffico si sta spostando da micro-test speculativi a pagamenti reali. Su tutte le chain supportate, non solo Base, i dati riportati coincidevano con circa 69.000 agenti attivi, 165 milioni di transazioni e circa 50 milioni di dollari di volume cumulativo al 21 aprile 2026, in concomitanza con il lancio della directory Agent.market. Google porta avanti in parallelo un proprio standard concorrente e in parte complementare, AP2 (Agent Payments Protocol), con oltre 60 partner tra cui Mastercard, PayPal e Coinbase.<\/p><figure class='wp-block-table'><table><thead><tr><th>Metrica<\/th><th>Valore<\/th><th>Periodo di riferimento<\/th><\/tr><\/thead><tbody><tr><td>Transazioni cumulative su Base<\/td><td>~100 milioni<\/td><td>da met\u00e0 2025 al primo trimestre 2026<\/td><\/tr><tr><td>Agenti attivi (tutte le chain)<\/td><td>~69.000<\/td><td>al 21 aprile 2026<\/td><\/tr><tr><td>Transazioni totali (tutte le chain)<\/td><td>~165 milioni<\/td><td>al 21 aprile 2026<\/td><\/tr><tr><td>Volume cumulativo<\/td><td>~50 milioni $<\/td><td>al 21 aprile 2026<\/td><\/tr><tr><td>Membri fondatori x402 Foundation<\/td><td>14<\/td><td>dal 14 luglio 2026<\/td><\/tr><\/tbody><\/table><\/figure><h2 class='wp-block-heading'>La contraddizione dell&#8217;offerta: carenza di GPU o eccesso di capacit\u00e0?<\/h2><p class=\"wp-block-paragraph\">Qui il quadro si complica. I dati di <a href='https:\/\/messari.io\/report\/state-of-akash-q1-2026-final'>Messari sul primo trimestre 2026<\/a> mostrano un Akash in contrazione sul lato dell&#8217;offerta: i provider attivi sono scesi a 58, un minimo storico, da 69 un anno prima; le GPU disponibili sono calate a 334 da 587; quelle effettivamente in uso sono scese a 84 da 198, per un tasso di utilizzo del 33,7%. Allo stesso tempo i nuovi contratti di leasing sono saliti del 27,1% trimestre su trimestre, a 43.540, ma i ricavi da leasing sono calati del 45% nello stesso periodo, a soli 253.250 dollari, che annualizzati restano poco pi\u00f9 di un milione, a fronte di un fatturato dell&#8217;intero 2025 di 3,15 milioni di dollari.<\/p><p class=\"wp-block-paragraph\">Pi\u00f9 contratti ma meno ricavi, pi\u00f9 domanda nominale ma meno provider disposti a restare: \u00e8 il tipo di frizione che una narrativa puramente ottimistica tende a ignorare. Nello stesso periodo, per\u00f2, Render Network raccontava l&#8217;esatto opposto: a giugno 2026 la rete ha registrato quello che alcuni osservatori hanno definito il primo evento di offerta negativa di GPU dal 2018, con la domanda che ha superato l&#8217;offerta nonostante l&#8217;arrivo di oltre 60.000 nuove GPU in 180 paesi in sei mesi grazie all&#8217;integrazione con Salad Technologies.<\/p><p class=\"wp-block-paragraph\">Le due reti non sono direttamente comparabili, Akash \u00e8 generalista, Render \u00e8 concentrata su rendering 3D e, sempre pi\u00f9, inferenza AI, ma insieme suggeriscono che il vero collo di bottiglia del settore non sia la scarsit\u00e0 grezza di GPU, quanto l&#8217;abbinamento tra domanda pagante affidabile e offerta disponibile. Non \u00e8 un caso che proprio Akash, la rete con il problema di utilizzo pi\u00f9 severo, sia anche quella che ha deciso di lasciare la propria chain Cosmos per un modello di sicurezza condivisa, dopo che il cambio di licenza del modulo Enterprise di Cosmos SDK nell&#8217;aprile 2026 ha spinto Osuri a scrivere su X che quella mossa avrebbe impedito ad Akash di \u00abdistribuirlo in produzione, usarlo commercialmente in alcun modo, offrirlo come servizio a terzi\u00bb. Anche sommando i numeri di Akash e Render, il confronto con la scala di CoreWeave, che da sola gestisce un portafoglio ordini vicino ai 100 miliardi di dollari, resta impietoso: la partita della decentralizzazione si gioca su un ordine di grandezza completamente diverso rispetto agli hyperscaler.<\/p><h2 class='wp-block-heading'>Quanto costa davvero rispetto al cloud centralizzato?<\/h2><p class=\"wp-block-paragraph\">Sul prezzo per ora di una singola GPU, il divario tra reti decentralizzate e hyperscaler \u00e8 reale. Un&#8217;istanza H100 su Akash costa indicativamente tra 1,30 e 2 dollari l&#8217;ora, contro i 4-7 dollari e oltre della tariffa on-demand dei cloud maggiori; un cluster da 8 GPU su io.net \u00e8 quotato tra 12 e 28 dollari l&#8217;ora, contro i circa 32,77 dollari di un&#8217;istanza equivalente p4d.24xlarge su AWS. Akash sostiene che AkashML tagli i costi di inferenza fino all&#8217;85% rispetto al cloud tradizionale, una cifra da trattare come claim aziendale pi\u00f9 che come dato indipendente, ma coerente con l&#8217;ordine di grandezza osservato altrove.<\/p><p class=\"wp-block-paragraph\">Il problema \u00e8 la scala. Il fatturato annualizzato dell&#8217;intero settore del GPU compute decentralizzato si aggira sui 180-220 milioni di dollari; CoreWeave da sola ha fatturato pi\u00f9 di dieci volte tanto in un solo trimestre. Per un&#8217;applicazione che deve rispondere a diecimila richieste di inferenza al giorno con un modello aperto come Llama 3.3, la differenza tra 1,50 e 5 dollari l&#8217;ora di GPU si traduce facilmente in una differenza di svariate migliaia di euro al mese, un margine che pesa soprattutto per chi opera con pochi centesimi di ricavo per richiesta, come spesso accade proprio per gli agenti AI descritti in questo pezzo. Il pubblico naturale per questo risparmio resta per\u00f2 chi pu\u00f2 tollerare maggiore variabilit\u00e0 e minore garanzia di uptime: sviluppatori indipendenti, sperimentazione, e appunto agenti che distribuiscono il traffico su pi\u00f9 provider invece di dipendere da uno solo.<\/p><figure class='wp-block-table'><table><thead><tr><th>Fornitore<\/th><th>Tipologia<\/th><th>Costo indicativo H100 (dollari\/ora)<\/th><\/tr><\/thead><tbody><tr><td>Akash Network<\/td><td>Decentralizzato<\/td><td>~1,30 &#8211; 2,00<\/td><\/tr><tr><td>io.net (cluster da 8 GPU)<\/td><td>Decentralizzato<\/td><td>~12 &#8211; 28 (intero cluster, non a GPU singola)<\/td><\/tr><tr><td>Cloud maggiori (media on-demand)<\/td><td>Centralizzato<\/td><td>~4 &#8211; 7+<\/td><\/tr><tr><td>AWS p4d.24xlarge<\/td><td>Centralizzato<\/td><td>~32,77<\/td><\/tr><\/tbody><\/table><\/figure>","protected":false},"excerpt":{"rendered":"<p>Gli sviluppatori umani non hanno abbandonato AWS e OpenAI, ma gli agenti AI autonomi s\u00ec, pagando in stablecoin con x402. Ecco chi usa davvero Bittensor, Akash, Render e Ritual a fine 2026.<\/p>\n","protected":false},"author":5,"featured_media":232,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[13],"tags":[],"class_list":["post-231","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai-crypto"],"_links":{"self":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/posts\/231","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/users\/5"}],"replies":[{"embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/comments?post=231"}],"version-history":[{"count":0,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/posts\/231\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/media\/232"}],"wp:attachment":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/media?parent=231"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/categories?post=231"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/tags?post=231"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}