{"id":195,"date":"2026-07-18T22:40:52","date_gmt":"2026-07-18T22:40:52","guid":{"rendered":"https:\/\/hoge.gg\/it\/inferenza-decentralizzata-ai-crypto-spiegata\/"},"modified":"2026-07-18T22:40:52","modified_gmt":"2026-07-18T22:40:52","slug":"inferenza-decentralizzata-ai-crypto-spiegata","status":"publish","type":"post","link":"https:\/\/hoge.gg\/it\/inferenza-decentralizzata-ai-crypto-spiegata\/","title":{"rendered":"Inferenza decentralizzata: cos&#8217;\u00e8 e come funziona nell&#8217;AI crypto"},"content":{"rendered":"<p class=\"wp-block-paragraph\">Negli ultimi diciotto mesi, la parte del cluster ai-crypto che cresce pi\u00f9 in fretta non \u00e8 quella dei chatbot o degli agenti autonomi, ma quella infrastrutturale: le reti che promettono di far girare i modelli di intelligenza artificiale senza passare per i data center di Amazon, Microsoft o Google. Il termine tecnico \u00e8 inferenza decentralizzata, e nel 2026 sta smettendo di essere uno slogan da white paper per diventare un mercato reale, con capitalizzazioni miliardarie, ricavi ancora piccoli rispetto ai concorrenti centralizzati, e pi\u00f9 di un rischio da conoscere prima di considerarla un&#8217;alternativa seria al cloud tradizionale.<\/p><h2 class='wp-block-heading'>Cos&#8217;\u00e8 l&#8217;inferenza AI e perch\u00e9 \u00e8 diversa dal training<\/h2><p class=\"wp-block-paragraph\">Quando si parla di intelligenza artificiale nel crypto, il termine che circola di pi\u00f9 negli ultimi mesi \u00e8 inferenza decentralizzata. Prima di capire perch\u00e9 mezza dozzina di reti blockchain ci stia scommettendo capitalizzazioni miliardarie, conviene separare due concetti che vengono spesso confusi: il training e l&#8217;inferenza.<\/p><p class=\"wp-block-paragraph\">Il training \u00e8 la fase in cui un modello, una rete neurale, un large language model, un sistema di visione artificiale, viene addestrato su enormi quantit\u00e0 di dati. Richiede cluster di migliaia di GPU collegate con interconnessioni a bassissima latenza (NVLink, InfiniBand), perch\u00e9 le schede devono scambiarsi di continuo gradienti e pesi durante l&#8217;addestramento. Un errore di sincronizzazione, anche minimo, pu\u00f2 rovinare settimane di calcolo. Per questo il training resta, ancora oggi, un territorio quasi esclusivo dei grandi laboratori (OpenAI, Google DeepMind, Anthropic, Meta) e dei fornitori cloud che affittano loro l&#8217;hardware.<\/p><p class=\"wp-block-paragraph\">L&#8217;inferenza \u00e8 un&#8217;altra cosa: \u00e8 il momento in cui il modello, gi\u00e0 addestrato, viene semplicemente interrogato per produrre una risposta, un&#8217;immagine, una previsione. Ogni richiesta \u00e8 in gran parte indipendente dalle altre, quindi non serve la stessa sincronizzazione millimetrica del training, il che rende l&#8217;inferenza molto pi\u00f9 facile da distribuire su hardware eterogeneo e sparso geograficamente, anche non professionale. Questa differenza tecnica spiega perch\u00e9 quasi tutti i progetti crypto che parlano di AI decentralizzata partano proprio dall&#8217;inferenza e non dal training: \u00e8 la parte del problema pi\u00f9 facile da risolvere con un mercato di computer sconnessi tra loro.<\/p><p class=\"wp-block-paragraph\">Non \u00e8 un dettaglio da addetti ai lavori. Secondo le stime di <a href='https:\/\/www.marketsandmarkets.com\/Market-Reports\/ai-inference-market-189921964.html'>MarketsAndMarkets<\/a>, il mercato globale dell&#8217;inferenza AI valeva circa 106 miliardi di dollari nel 2025 ed \u00e8 atteso oltre i 250 miliardi entro il 2030, un ritmo di crescita che pochi altri settori tecnologici possono vantare. Ed \u00e8 un mercato oggi controllato quasi per intero da un pugno di fornitori: Amazon Web Services, Microsoft Azure, Google Cloud, pi\u00f9 i laboratori che vendono accesso diretto ai propri modelli, come OpenAI e Anthropic.<\/p><h2 class='wp-block-heading'>Perch\u00e9 decentralizzare l&#8217;inferenza? Il problema dei cloud centralizzati<\/h2><p class=\"wp-block-paragraph\">La domanda naturale \u00e8: se il cloud centralizzato funziona, perch\u00e9 complicarsi la vita con blockchain, token e provider sconosciuti sparsi per il mondo? Il settore crypto individua tre problemi concreti.<\/p><ul class='wp-block-list'><li>Scarsit\u00e0 di GPU: nonostante nuove fabbriche e nuovi chip, l&#8217;offerta di acceleratori Nvidia di fascia alta resta tirata; il collo di bottiglia non \u00e8 tanto la produzione dei chip in s\u00e9 quanto il packaging avanzato e la memoria ad alta banda, entrambi gi\u00e0 allocati per mesi.<\/li><li>Concentrazione dell&#8217;offerta: tre o quattro aziende controllano la maggior parte della capacit\u00e0 di calcolo cloud mondiale, e se un&#8217;app AI dipende in toto da un unico fornitore, quel fornitore pu\u00f2 in teoria cambiare i prezzi, sospendere l&#8217;account o limitare l&#8217;accesso a un modello in una determinata giurisdizione.<\/li><li>Incompatibilit\u00e0 con gli smart contract: una blockchain \u00e8 deterministica per costruzione, mentre una chiamata a un&#8217;API centralizzata introduce un punto di fiducia esterno che i protocolli faticano a gestire in modo nativo.<\/li><\/ul><p class=\"wp-block-paragraph\">Il risultato pratico del primo problema \u00e8 che affittare un H100 su cloud tradizionale costa oggi, a seconda del fornitore e della durata dell&#8217;impegno, tra circa 1,50 e 6 euro l&#8217;ora (1,80-7 dollari), con punte storiche ben pi\u00f9 alte nei momenti di massima scarsit\u00e0, secondo l&#8217;<a href='https:\/\/newsletter.semianalysis.com\/p\/the-great-gpu-shortage-rental-capacity'>indice H100 di SemiAnalysis<\/a>. Chi ha gi\u00e0 capacit\u00e0 riservata tende a tenersela stretta, rendendo ancora pi\u00f9 difficile trovarne di nuova sul mercato spot.<\/p><p class=\"wp-block-paragraph\">Il terzo problema \u00e8 quello pi\u00f9 specifico del mondo crypto, e spiega perch\u00e9 servano protocolli costruiti apposta: uno smart contract non pu\u00f2, da solo, chiamare un&#8217;API esterna come quella di OpenAI e fidarsi ciecamente della risposta. Serve un livello intermedio, decentralizzato quanto la blockchain stessa, capace di fornire output AI agli smart contract senza reintrodurre un singolo punto di fallimento o di censura.<\/p><h2 class='wp-block-heading'>Le tre architetture dell&#8217;inferenza decentralizzata<\/h2><p class=\"wp-block-paragraph\">Con inferenza decentralizzata si indicano oggi almeno tre modelli architetturali abbastanza diversi tra loro, spesso confusi nello stesso discorso.<\/p><p class=\"wp-block-paragraph\">Il primo \u00e8 il marketplace di GPU: una sorta di mercato dell&#8217;affitto del calcolo, dove chi possiede hardware, da un rack professionale a una scheda consumer in un garage, lo mette a disposizione, un meccanismo di abbinamento (spesso un&#8217;asta) incontra domanda e offerta, e un token regola pagamenti e incentivi. \u00c8 il modello di Akash Network, io.net, Nosana e, in parte, Render Network.<\/p><p class=\"wp-block-paragraph\">Il secondo \u00e8 il modello a subnet, reso popolare da Bittensor: invece di limitarsi ad affittare hardware, la rete premia chi produce il miglior output secondo una metrica di qualit\u00e0 definita dalla community. I miner competono a fornire risposte, i validator le classificano, e un algoritmo di consenso, Yuma Consensus nel caso di Bittensor, distribuisce le ricompense in proporzione al valore percepito del lavoro svolto, non solo all&#8217;hardware messo a disposizione.<\/p><p class=\"wp-block-paragraph\">Il terzo \u00e8 il modello coprocessor, o oracolo AI: un livello che permette agli smart contract di chiamare un modello AI e ricevere una risposta on-chain, con qualche garanzia, crittografica, economica o basata su hardware, che il calcolo sia stato eseguito correttamente. \u00c8 l&#8217;approccio di Ritual, e in parte quello dei layer di verifica come EigenAI, un tema che approfondiamo pi\u00f9 avanti in questo articolo.<\/p><p class=\"wp-block-paragraph\">Nessuno dei tre modelli \u00e8 il migliore in assoluto: rispondono a esigenze diverse. Un marketplace GPU \u00e8 la scelta giusta quando serve calcolo grezzo a basso costo, senza troppe pretese su chi lo fornisce. Un modello a subnet ha senso quando la qualit\u00e0 della risposta conta pi\u00f9 della semplice disponibilit\u00e0 hardware. Un coprocessor serve quando \u00e8 uno smart contract, non un&#8217;app tradizionale, a dover consumare l&#8217;output AI.<\/p><h2 class='wp-block-heading'>Bittensor: il modello a subnet e il consenso di Yuma<\/h2><p class=\"wp-block-paragraph\">Bittensor, lanciato nel 2019 da Jacob Steeves e Ala Shaabana, \u00e8 oggi la rete di AI decentralizzata con la capitalizzazione pi\u00f9 alta: il token TAO valeva circa 171 euro a met\u00e0 luglio 2026, per una capitalizzazione di circa 1,64 miliardi di euro, tra le prime 40 criptovalute per capitalizzazione (il prezzo era sceso di oltre il 16% nel mese precedente la rilevazione, un promemoria di quanto siano volatili questi dati).<\/p><p class=\"wp-block-paragraph\">L&#8217;idea di fondo \u00e8 replicare la logica del mining di Bitcoin, ma invece di premiare chi risolve un puzzle crittografico fine a se stesso, premia chi produce informazione utile: una risposta di un modello linguistico, una previsione, un&#8217;immagine generata. La rete \u00e8 organizzata in oltre cento subnet indipendenti, ciascuna con un proprio compito e una propria metrica di qualit\u00e0. All&#8217;interno di ogni subnet, i miner competono a fornire il miglior output e i validator, i primi 64 nodi per emissioni su un massimo di 256 partecipanti attivi per subnet, ne valutano il lavoro assegnando pesi. Il <a href='https:\/\/docs.learnbittensor.org\/learn\/yuma-consensus'>meccanismo di Yuma Consensus<\/a> converte queste valutazioni in due flussi di ricompensa, uno per i miner e uno per i validator, dando pi\u00f9 peso ai giudizi dei validator storicamente pi\u00f9 affidabili.<\/p><p class=\"wp-block-paragraph\">Due subnet in particolare sono diventate il fulcro dell&#8217;inferenza vera e propria su Bittensor: Chutes, pensata per l&#8217;inferenza serverless a basso costo, e Targon, gestita da Manifold Labs, che punta su inferenza verificabile e a bassa latenza per applicazioni consumer.<\/p><p class=\"wp-block-paragraph\">Jacob Steeves ha descritto l&#8217;ambizione del progetto in termini quasi militanti contro la centralizzazione dell&#8217;AI. Per usare le sue parole, riportate da <a href='https:\/\/iq.wiki\/wiki\/jacob-robert-steeves'>IQ.wiki<\/a>, la rete punta a costruire \u00abuna massiccia rete neurale decentralizzata pensata per comprendere meglio le informazioni nel mondo che ci circonda\u00bb, accessibile senza il permesso di un singolo laboratorio o fornitore cloud.<\/p><h2 class='wp-block-heading'>I marketplace GPU: Akash, io.net, Nosana e Render<\/h2><p class=\"wp-block-paragraph\">Il gruppo pi\u00f9 affollato \u00e8 quello dei marketplace di GPU puri, che non giudicano la qualit\u00e0 dell&#8217;output ma si limitano ad abbinare domanda e offerta di calcolo.<\/p><p class=\"wp-block-paragraph\">Akash Network, fondato nel 2018 da Greg Osuri e Adam Bozanich, \u00e8 una blockchain Cosmos indipendente, nata come cloud generalista per CPU e storage e diventata marketplace GPU solo con l&#8217;aggiornamento Supercloud del 2023. Funziona ad asta inversa: chi cerca calcolo pubblica un manifesto con i requisiti, i provider fanno offerte al ribasso, il richiedente sceglie, senza essere obbligato a prendere l&#8217;offerta pi\u00f9 economica. Il token AKT valeva circa 0,47 euro a met\u00e0 luglio 2026, per una capitalizzazione di circa 140 milioni di euro. Akash ha anche lanciato AkashML, un layer di inferenza gestita che ospita modelli come Llama 3.3 e DeepSeek V3 e che, secondo l&#8217;azienda stessa, servirebbe oltre 10 miliardi di token al giorno a inizio luglio 2026. Il fondatore Greg Osuri ha riassunto cos\u00ec la sfida strutturale del settore nel <a href='https:\/\/akash.network\/blog\/akash-network-q1-2026-report\/'>report del primo trimestre 2026<\/a> di Akash: \u00abl&#8217;AI si muove in mesi, l&#8217;energia si muove in anni\u00bb.<\/p><p class=\"wp-block-paragraph\">io.net, costruito su Solana, aggrega GPU di data center, ex miner di Ethereum riconvertiti dopo il passaggio a Proof of Stake e cluster consumer. Il fondatore Ahmad Shadid \u00e8 partito dal problema opposto: costruendo un proprio cluster GPU per trading quantitativo ad alta frequenza, si \u00e8 scontrato con i costi dei fornitori centralizzati, da cui l&#8217;idea, come si legge nella <a href='https:\/\/io.net\/docs\/guides\/inception'>documentazione ufficiale del progetto<\/a>, che \u00abl&#8217;infrastruttura dietro l&#8217;AI non dovrebbe stare nelle mani di poche grandi corporation\u00bb. Il token IO valeva circa 0,17 dollari a met\u00e0 luglio 2026, con una capitalizzazione di circa 62 milioni di dollari.<\/p><p class=\"wp-block-paragraph\">Render Network, nato per il rendering grafico distribuito e poi esteso all&#8217;inferenza AI, \u00e8 passato da Ethereum a Solana per gestire meglio il coordinamento in tempo reale dei nodi. Il token RENDER capitalizzava circa 671 milioni di euro a met\u00e0 luglio 2026, il pi\u00f9 capitalizzato tra i marketplace GPU puri dopo Bittensor. Nosana, costruito su Solana e pensato per sviluppatori indipendenti in cerca di inferenza a basso costo, \u00e8 invece un progetto molto pi\u00f9 piccolo, con una capitalizzazione di circa 25 milioni di euro.<\/p><h2 class='wp-block-heading'>Ritual: i coprocessor on-chain per gli smart contract<\/h2><p class=\"wp-block-paragraph\">Ritual segue una logica diversa da un marketplace o da una subnet: invece di vendere calcolo grezzo o classificare output, costruisce un ponte tra gli smart contract e i modelli AI.<\/p><p class=\"wp-block-paragraph\">Fondata a New York nel 2023 da Niraj Pant, per sei anni general partner di Polychain Capital, e Akilesh Potti, Ritual ha raccolto 25 milioni di dollari in un round Series A guidato da Archetype, con la partecipazione tra gli altri di Balaji Srinivasan, Accel e Robot Ventures, come riportato da <a href='https:\/\/cointelegraph.com\/news\/ai-infrastructure-startup-ritual-raises-25-m-gaps-crypto'>Cointelegraph<\/a> nel novembre 2023.<\/p><p class=\"wp-block-paragraph\">La prima incarnazione del progetto, Infernet, \u00e8 una rete di oracoli decentralizzata: un contratto chiama un nodo Infernet, il nodo esegue l&#8217;inferenza fuori dalla catena e restituisce il risultato on-chain, con la possibilit\u00e0 di allegare una garanzia crittografica (prova a conoscenza zero) o basata su hardware (Trusted Execution Environment) sul fatto che il calcolo sia stato eseguito come richiesto. Oggi una rete diffusa di nodi Infernet esegue questi calcoli fuori dalla catena in tutto il mondo. Il passo successivo, Ritual Chain, sostituisce Infernet con precompilati nativi: quando un contratto chiama una funzione come HTTP o LLM, il lavoro effettivo avviene fuori dalla catena dentro un Trusted Execution Environment, ma il risultato rientra nell&#8217;esecuzione della catena come se fosse stato calcolato on-chain.<\/p><p class=\"wp-block-paragraph\">A differenza di Bittensor, Akash o io.net, Ritual non ha ancora un token in circolazione con una capitalizzazione di mercato verificabile a met\u00e0 2026: resta, sotto questo profilo, un progetto in una fase pi\u00f9 orientata al protocollo che ai numeri di mercato. Il suo interesse per chi segue il cluster ai-crypto sta soprattutto nell&#8217;architettura, pensata per gli agenti AI e gli smart contract che devono consumare output AI con qualche garanzia di correttezza.<\/p><h2 class='wp-block-heading'>Gensyn e il confine tra training e inferenza decentralizzati<\/h2><p class=\"wp-block-paragraph\">Vale una precisazione su Gensyn, di cui HOGE Wire si \u00e8 gi\u00e0 occupato in due pezzi dedicati dopo il lancio della mainnet e del token $AI. Gensyn nasce per il training distribuito, non per l&#8217;inferenza: il suo strato di verifica, Verde, e i suoi RepOps (Reproducible Operators) risolvono un problema specifico del training, cio\u00e8 garantire che calcoli eseguiti su hardware diverso producano risultati identici bit per bit, condizione necessaria per addestrare un modello in modo affidabile su un insieme eterogeneo di macchine sconnesse tra loro.<\/p><p class=\"wp-block-paragraph\">Detto questo, l&#8217;architettura di Gensyn a quattro livelli include AXL (Agent eXchange Layer), un layer di comunicazione peer to peer per gli agenti AI che supporta i protocolli MCP e A2A: la stessa infrastruttura potrebbe in futuro instradare anche richieste di inferenza tra agenti, non solo compiti di training. \u00c8 un promemoria utile: la linea che separa decentralizzare il training da decentralizzare l&#8217;inferenza, nel 2026, \u00e8 meno netta di quanto sembri sulla carta, e diversi progetti nati per un caso d&#8217;uso stanno allargando lo sguardo all&#8217;altro. Per l&#8217;approfondimento su Gensyn, mainnet, Delphi e la volatilit\u00e0 del token $AI, HOGE Wire ha gi\u00e0 pubblicato una copertura dedicata.<\/p><h2 class='wp-block-heading'>Il confronto tra i protagonisti dell&#8217;inferenza decentralizzata<\/h2><p class=\"wp-block-paragraph\">Per orientarsi tra architetture diverse, ecco un confronto sintetico tra i sei protocolli citati finora, con dati indicativi a met\u00e0 luglio 2026: capitalizzazioni e prezzi sono soggetti a forte volatilit\u00e0 e vanno riverificati al momento della lettura.<\/p><figure class='wp-block-table'><table><thead><tr><th>Protocollo<\/th><th>Modello architetturale<\/th><th>Token<\/th><th>Capitalizzazione (met\u00e0 lug. 2026)<\/th><th>Caratteristica distintiva<\/th><\/tr><\/thead><tbody><tr><td>Bittensor<\/td><td>Subnet a incentivi (Yuma Consensus)<\/td><td>TAO<\/td><td>circa 1,64 mld EUR (rank #40)<\/td><td>Oltre 100 subnet specializzate, incluse Chutes e Targon per l&#8217;inferenza<\/td><\/tr><tr><td>Render Network<\/td><td>Marketplace GPU (rendering e AI)<\/td><td>RENDER<\/td><td>circa 671 mln EUR (rank #73)<\/td><td>Nato per il rendering 3D, esteso all&#8217;inferenza AI su Solana<\/td><\/tr><tr><td>Akash Network<\/td><td>Marketplace GPU ad asta inversa<\/td><td>AKT<\/td><td>circa 140 mln EUR (rank #186)<\/td><td>Cloud generalista con layer di inferenza gestita AkashML<\/td><\/tr><tr><td>io.net<\/td><td>Marketplace GPU aggregato<\/td><td>IO<\/td><td>circa 62 mln USD (~54 mln EUR)<\/td><td>Aggrega data center, ex mining Ethereum e cluster consumer su Solana<\/td><\/tr><tr><td>Nosana<\/td><td>Marketplace GPU su Solana<\/td><td>NOS<\/td><td>circa 25 mln EUR (rank #625)<\/td><td>Inferenza a basso costo per sviluppatori indipendenti<\/td><\/tr><tr><td>Ritual<\/td><td>Coprocessor on-chain (Infernet, Ritual Chain)<\/td><td>token non ancora quotato<\/td><td>n\/d<\/td><td>Porta output AI verificabili dentro gli smart contract<\/td><\/tr><\/tbody><\/table><\/figure><p class=\"wp-block-paragraph\">Dati di prezzo e capitalizzazione per Bittensor, Akash Network, Render, io.net e Nosana: <a href='https:\/\/www.coingecko.com\/'>CoinGecko<\/a>, rilevazione di met\u00e0 luglio 2026; trattandosi di un settore ad alta volatilit\u00e0, i valori vanno riverificati al momento della lettura. Va inoltre notato che la capitalizzazione di mercato da sola dice poco sull&#8217;utilizzo reale della rete sottostante, un punto su cui torniamo tra due paragrafi parlando dei rischi di concentrazione.<\/p><h2 class='wp-block-heading'>Il tallone d&#8217;Achille: come sai che l&#8217;inferenza \u00e8 corretta?<\/h2><p class=\"wp-block-paragraph\">C&#8217;\u00e8 un problema che nessuno dei modelli descritti finora risolve del tutto da solo: come fai a sapere che il provider a cui hai affidato il calcolo ha davvero eseguito il modello richiesto, e non una versione pi\u00f9 economica e pi\u00f9 scadente, o peggio non l&#8217;ha eseguito affatto, limitandosi a restituire un output plausibile?<\/p><p class=\"wp-block-paragraph\">In un marketplace puro come Akash o io.net, la risposta di default \u00e8 che non lo sai: ti fidi della reputazione del provider e degli eventuali meccanismi di rating della piattaforma. In un modello a subnet come Bittensor, la fiducia si sposta sui validator, che a loro volta devono essere incentivati a valutare onestamente il lavoro dei miner, il compito di Yuma Consensus. Solo i protocolli pensati esplicitamente per la verifica provano a sostituire la fiducia con una prova.<\/p><p class=\"wp-block-paragraph\">Come ha scritto Vitalik Buterin nel suo saggio <a href='https:\/\/vitalik.eth.limo\/general\/2024\/01\/30\/cryptoai.html'>The promise and challenges of crypto + AI applications<\/a>, il calcolo verificabile sposta il modello di fiducia da fidati del server a verifica la prova: un cambiamento enorme quando \u00e8 un agente AI, e non una persona, a decidere se accettare un output e magari a muovere fondi sulla base di quella decisione. Le quattro famiglie di tecniche che provano a farlo, dai proof a conoscenza zero di RISC Zero e Succinct alle Trusted Execution Environment di Phala Network, fino ai layer crypto economici come EigenCloud, sono l&#8217;oggetto del nostro approfondimento dedicato al <a href='https:\/\/hoge.gg\/it\/verifiable-compute-ai-crypto-spiegato\/'>verifiable compute<\/a>. Qui vale la pena ricordare solo che decentralizzato e verificabile non sono sinonimi: una rete pu\u00f2 essere ampiamente distribuita e comunque richiedere un atto di fiducia sull&#8217;onest\u00e0 dei singoli nodi, come accade oggi nella maggior parte dei marketplace GPU descritti in questo articolo.<\/p><h2 class='wp-block-heading'>L&#8217;economia dei token: incentivi, staking e modelli di burn<\/h2><p class=\"wp-block-paragraph\">Ogni rete ha bisogno di un meccanismo che convinca migliaia di proprietari di GPU sparsi per il mondo a mettere a disposizione hardware invece di usarlo per altro (mining, gaming, altri carichi di lavoro), e che scoraggi comportamenti scorretti. La soluzione quasi universale \u00e8 un token nativo con tre funzioni: pagamento, incentivo e, in alcuni casi, penalit\u00e0.<\/p><p class=\"wp-block-paragraph\">Akash usa un meccanismo di Burn Mint Equilibrium, attivo dal marzo 2026: chi affitta calcolo brucia AKT per coniare un credito di regolamento agganciato al dollaro, e il provider viene pagato in AKT al prezzo di regolamento corrente. \u00c8 un modo per disaccoppiare il prezzo del calcolo, stabile perch\u00e9 espresso in dollari, dal prezzo del token, volatile, pur mantenendo il token al centro dei flussi di pagamento. L&#8217;inflazione di AKT resta comunque elevata: secondo <a href='https:\/\/messari.io\/report\/state-of-akash-q1-2026-final'>Messari<\/a>, l&#8217;inflazione realizzata su base annua ha toccato l&#8217;8,94% nel primo trimestre 2026, sopra il tetto dell&#8217;8% fissato dal protocollo, il che significa che chi mette in staking il token per proteggersi dalla diluizione ottiene spesso un rendimento reale vicino allo zero o negativo.<\/p><p class=\"wp-block-paragraph\">Bittensor distribuisce TAO come ricompensa sia ai miner, in base alla qualit\u00e0 del lavoro giudicata dai validator, sia ai validator stessi, subnet per subnet, con un tetto di emissione fissato dal protocollo. Dal passaggio al modello dynamic TAO, ogni subnet ha anche un proprio sotto-token, chiamato alpha, il cui prezzo relativo a TAO riflette quanto la community valuta quella specifica subnet: un meccanismo di mercato interno che in teoria dovrebbe indirizzare capitale ed emissioni verso le subnet pi\u00f9 utili, per esempio quelle di inferenza come Chutes e Targon, e allontanarlo da quelle meno performanti.<\/p><p class=\"wp-block-paragraph\">In generale, il rischio strutturale di questi modelli \u00e8 lo stesso di molte reti Proof of Stake: se l&#8217;emissione di nuovi token supera la domanda reale di calcolo, il valore del token si diluisce pi\u00f9 velocemente di quanto cresca l&#8217;utilizzo effettivo della rete.<\/p><h2 class='wp-block-heading'>Quanto \u00e8 davvero decentralizzata? I rischi di concentrazione<\/h2><p class=\"wp-block-paragraph\">Vale la pena un bagno di realt\u00e0: decentralizzato non significa automaticamente n\u00e9 economicamente competitivo, n\u00e9 privo di colli di bottiglia.<\/p><p class=\"wp-block-paragraph\">Il primo limite \u00e8 la scala. L&#8217;intero settore del calcolo GPU decentralizzato genera, secondo le stime raccolte da <a href='https:\/\/yellow.com\/research\/ai-compute-demand-crypto-gpu-networks-gap-2026'>Yellow.com<\/a>, ricavi annualizzati complessivi nell&#8217;ordine di 180-220 milioni di dollari: una frazione minima se paragonata al fatturato di un singolo grande fornitore di calcolo AI centralizzato quotato in borsa, che nello stesso arco di tempo supera comodamente il miliardo di dollari a trimestre.<\/p><p class=\"wp-block-paragraph\">Il secondo limite \u00e8 l&#8217;utilizzo reale dell&#8217;hardware disponibile. I dati di <a href='https:\/\/messari.io\/report\/state-of-akash-q1-2026-final'>Messari<\/a> sulla rete Akash mostrano un tasso di utilizzo delle GPU del 33,7% nel primo trimestre 2026, con il numero di provider attivi sceso a 58 (il minimo storico, contro 63 nel trimestre precedente e 69 un anno prima) e i ricavi da lease in calo del 45% rispetto al trimestre precedente, a circa 253.000 dollari. Il dato contrasta con le comunicazioni della stessa Akash, che nello stesso periodo ha rivendicato una spesa in calcolo da record e miliardi di token al giorno serviti tramite AkashML: \u00e8 probabile che la discrepanza rifletta perimetri di misurazione diversi, ricavi da lease puro contro ricavi complessivi del prodotto, ma resta un esempio di quanto sia difficile oggi verificare in modo indipendente quanta capacit\u00e0 di queste reti sia davvero utilizzata rispetto a quanta sia semplicemente registrata.<\/p><p class=\"wp-block-paragraph\">Il terzo limite riguarda l&#8217;hardware stesso: gran parte del calcolo AI di fascia alta richiede GPU Nvidia recenti (H100, H200, B200), le stesse scarse e costose anche per gli hyperscaler. Le reti decentralizzate competono quindi per lo stesso hardware conteso a livello globale, e buona parte della loro capacit\u00e0 aggiuntiva viene in pratica da schede di fascia consumer o da data center pi\u00f9 piccoli, competitivi solo su alcuni carichi di lavoro, come l&#8217;inferenza di modelli pi\u00f9 piccoli, non sul training di modelli di frontiera. Diversi progetti, Akash in testa, stanno abbassando le barriere all&#8217;ingresso per i piccoli provider, per esempio permettendo di partecipare senza gestire un intero cluster Kubernetes, ma restano lontani dal poter competere sui carichi pi\u00f9 pesanti.<\/p><h2 class='wp-block-heading'>Inferenza decentralizzata contro centralizzata: costi e censura<\/h2><p class=\"wp-block-paragraph\">Come si confronta, in pratica, affidarsi a una rete decentralizzata rispetto a un&#8217;API centralizzata come quella di OpenAI o Anthropic, o a un cloud come AWS o Google Cloud? La risposta dipende molto dal caso d&#8217;uso, ma alcuni assi di confronto tornano sempre.<\/p><figure class='wp-block-table'><table><thead><tr><th>Aspetto<\/th><th>Cloud centralizzato (OpenAI, AWS, Google Cloud)<\/th><th>Rete decentralizzata<\/th><\/tr><\/thead><tbody><tr><td>Formazione del prezzo<\/td><td>Listino fissato dal fornitore<\/td><td>Asta o mercato competitivo tra provider<\/td><\/tr><tr><td>Accesso e censura<\/td><td>Il fornitore pu\u00f2 sospendere l&#8217;account o limitare l&#8217;accesso<\/td><td>Permissionless, pi\u00f9 difficile da bloccare<\/td><\/tr><tr><td>Garanzia sul risultato<\/td><td>Fiducia nella reputazione del fornitore<\/td><td>Da nessuna garanzia a TEE, prove crittografiche o staking economico, a seconda del protocollo<\/td><\/tr><tr><td>Affidabilit\u00e0 e SLA<\/td><td>Alta, contratti enterprise e ridondanza garantita<\/td><td>Variabile, dipende dal singolo provider o subnet<\/td><\/tr><tr><td>Trasparenza dei pagamenti<\/td><td>Fatturazione privata verso il singolo cliente<\/td><td>Transazioni on-chain, storicamente verificabili da chiunque<\/td><\/tr><\/tbody><\/table><\/figure><p class=\"wp-block-paragraph\">Sul fronte dei prezzi puri, il confronto non \u00e8 sempre favorevole alla decentralizzazione quanto il marketing di settore lascia intendere. Un modello di punta come GPT-5.5 costa, secondo il <a href='https:\/\/developers.openai.com\/api\/docs\/pricing'>listino ufficiale di OpenAI<\/a>, 5 dollari (circa 4,4 euro) per milione di token in input e 30 dollari (circa 26 euro) per milione in output, con sconti fino al 90% per l&#8217;input servito dalla cache. \u00c8 un prezzo per token, non per ora di GPU, quindi non direttamente comparabile con il costo orario del noleggio hardware, ma d\u00e0 la misura di quanto sia ormai aggressiva la competizione sui prezzi anche lato centralizzato. Le reti decentralizzate restano competitive soprattutto quando il carico di lavoro tollera una latenza pi\u00f9 alta e variabile, e quando chi le usa valorizza la resistenza alla censura o all&#8217;interruzione del servizio pi\u00f9 della garanzia di un accordo di livello di servizio enterprise.<\/p><h2 class='wp-block-heading'>Regolamentazione e fiscalit\u00e0 in Italia<\/h2><p class=\"wp-block-paragraph\">Dal punto di vista regolamentare italiano, l&#8217;inferenza decentralizzata in s\u00e9, cio\u00e8 il servizio di calcolo, non ricade sotto il regolamento MiCA: MiCA disciplina le cripto-attivit\u00e0 e i soggetti che le emettono o forniscono servizi su di esse, i CASP (Crypto-Asset Service Provider), non i servizi cloud o di calcolo in quanto tali. Il periodo transitorio di MiCA in Italia si \u00e8 chiuso il 1 luglio 2026, e da quella data la prestazione di servizi in cripto-attivit\u00e0 a clienti europei \u00e8 riservata ai CASP autorizzati o agli intermediari gi\u00e0 vigilati, come hanno ricordato congiuntamente <a href='https:\/\/www.consob.it\/web\/consob\/w\/termina-il-periodo-transitorio-del-regolamento-mica-sulle-cripto-attivit%C3%A0-in-italia-9-soggetti-abilitati'>Consob e Banca d&#8217;Italia<\/a> il 30 giugno 2026.<\/p><p class=\"wp-block-paragraph\">Dove MiCA entra in gioco \u00e8 sui token: quando TAO, AKT, IO, RENDER o NOS vengono offerti o scambiati tramite un CASP che serve clienti italiani, ricadono nella categoria residuale delle altre cripto-attivit\u00e0, non essendo n\u00e9 token di moneta elettronica n\u00e9 token collegati ad attivit\u00e0 di riserva, con i relativi obblighi di white paper e notifica in capo all&#8217;exchange o all&#8217;emittente. La Consob resta l&#8217;autorit\u00e0 competente su condotta e tutela degli investitori, la Banca d&#8217;Italia sui profili prudenziali, in base al decreto legislativo 5 settembre 2024, n. 129.<\/p><p class=\"wp-block-paragraph\">Sul fronte fiscale, chi partecipa a queste reti mettendo a disposizione hardware o token in staking, e incassa ricompense in TAO, AKT o altri token, si trova, per analogia con il trattamento gi\u00e0 chiarito per lo staking ordinario, di fronte allo stesso schema: la ricompensa costituisce reddito diverso, tassato al momento della ricezione al valore di mercato in euro, con l&#8217;aliquota del 33% in vigore dal 2026 e senza franchigia; un&#8217;eventuale ulteriore plusvalenza alla successiva cessione del token viene tassata di nuovo, separatamente, come guadagno in conto capitale. \u00c8 una doppia tassazione che sorprende molti utenti abituati a pensare solo al momento della vendita finale. Per il quadro completo su aliquote, scadenze e le novit\u00e0 normative pi\u00f9 recenti, HOGE Wire ha pubblicato diversi approfondimenti, tra cui uno dedicato alle <a href='https:\/\/hoge.gg\/it\/crypto-tax-2026-novita-oltre-aliquota-33\/'>novit\u00e0 del 2026 oltre l&#8217;aliquota del 33%<\/a> e uno su <a href='https:\/\/hoge.gg\/it\/crypto-tax-2026-scadenza-30-giugno-cosa-fare\/'>cosa fare se si \u00e8 saltata la scadenza del 30 giugno<\/a>.<\/p><p class=\"wp-block-paragraph\">Va segnalato, infine, che l&#8217;intera materia si intreccia con il tema pi\u00f9 ampio dell&#8217;adozione istituzionale delle infrastrutture crypto: HOGE Wire ha raccontato separatamente come stanno cambiando le regole per le <a href='https:\/\/hoge.gg\/it\/bank-crypto-policy-banche-cripto-2026\/'>banche che si avvicinano al settore cripto<\/a>, un fronte che nei prossimi mesi potrebbe intersecarsi anche con l&#8217;uso di infrastrutture AI verificabili per la conformit\u00e0 automatizzata.<\/p><h2 class='wp-block-heading'>Cosa aspettarsi nei prossimi mesi<\/h2><p class=\"wp-block-paragraph\">Alcuni segnali indicano dove si sta muovendo il settore. Il primo \u00e8 la convergenza tra i tre modelli architetturali descritti in questo articolo: Ritual costruisce precompilati che assomigliano sempre pi\u00f9 a un marketplace di calcolo generico, Bittensor ospita ormai subnet specializzate in inferenza serverless che competono direttamente con Akash o io.net sul terreno del prezzo, e diversi progetti di verifica stanno aggiungendo layer di calcolo decentralizzato sopra le proprie garanzie crittografiche o basate su hardware. Le etichette nette con cui si presentano oggi questi progetti, marketplace, subnet, coprocessor, potrebbero contare sempre meno rispetto a una domanda pi\u00f9 semplice: quanto costa, quanto \u00e8 veloce, quanto \u00e8 verificabile l&#8217;output.<\/p><p class=\"wp-block-paragraph\">Il secondo segnale \u00e8 la pressione della domanda reale di agenti AI autonomi, che potrebbe diventare il caso d&#8217;uso che giustifica davvero l&#8217;inferenza decentralizzata su scala, pi\u00f9 delle app rivolte all&#8217;utente finale: un agente che deve chiamare un modello AI centinaia di volte al giorno per compiti automatizzati \u00e8 pi\u00f9 sensibile al costo marginale per chiamata, e pi\u00f9 tollerante a una latenza leggermente pi\u00f9 alta, rispetto a una persona che aspetta una risposta in chat.<\/p><p class=\"wp-block-paragraph\">Il terzo segnale, meno ottimistico, \u00e8 che la scarsit\u00e0 di GPU di fascia alta a livello globale non si risolver\u00e0 a breve: gli analisti raccolti da <a href='https:\/\/newsletter.semianalysis.com\/p\/the-great-gpu-shortage-rental-capacity'>SemiAnalysis<\/a> collocano una possibile normalizzazione dell&#8217;offerta non prima del 2027. Fino ad allora, le reti decentralizzate competeranno per lo stesso hardware conteso dagli hyperscaler, il che significa che il loro successo dipender\u00e0 meno dalla tecnologia, gi\u00e0 oggi abbastanza matura, e pi\u00f9 dalla capacit\u00e0 di attrarre provider con margini realmente competitivi, non solo con incentivi in token destinati a diluirsi nel tempo.<\/p><h2 class='wp-block-heading'>Domande frequenti<\/h2><h3 class='wp-block-heading'>Cos&#8217;\u00e8 l&#8217;inferenza AI decentralizzata?<\/h3><p class=\"wp-block-paragraph\">\u00c8 l&#8217;esecuzione di un modello di intelligenza artificiale gi\u00e0 addestrato, per generare testo, immagini o previsioni, su una rete distribuita di GPU indipendenti, coordinata da un protocollo blockchain e da un token, invece che su un singolo cloud centralizzato come AWS, Google Cloud o Microsoft Azure. Il training del modello, cio\u00e8 la fase di addestramento vera e propria, resta invece un processo molto pi\u00f9 difficile da decentralizzare per via dei vincoli di sincronizzazione tra le GPU.<\/p><h3 class='wp-block-heading'>Qual \u00e8 la differenza tra Bittensor e un marketplace GPU come Akash o io.net?<\/h3><p class=\"wp-block-paragraph\">Akash e io.net funzionano come un mercato dell&#8217;affitto: chi ha hardware lo mette a disposizione, chi ne ha bisogno lo affitta, e il prezzo si forma tramite un meccanismo simile a un&#8217;asta. Bittensor invece premia chi produce il miglior output secondo una metrica di qualit\u00e0 giudicata da altri partecipanti della rete, i validator, non semplicemente chi mette a disposizione pi\u00f9 hardware: \u00e8 un mercato della qualit\u00e0 del lavoro svolto, non solo della capacit\u00e0 di calcolo grezza.<\/p><h3 class='wp-block-heading'>L&#8217;inferenza decentralizzata costa davvero meno di OpenAI o di un cloud come AWS?<\/h3><p class=\"wp-block-paragraph\">Dipende dal carico di lavoro. Per modelli open source di dimensioni medio piccole e carichi tolleranti a una latenza variabile, i marketplace decentralizzati possono offrire prezzi competitivi grazie alla concorrenza tra provider. Per i modelli di punta pi\u00f9 recenti, con requisiti di affidabilit\u00e0 di livello enterprise, il confronto \u00e8 meno netto: le API centralizzate hanno abbassato molto i prezzi negli ultimi anni e restano spesso pi\u00f9 semplici da integrare.<\/p><h3 class='wp-block-heading'>Come si fa a sapere se una rete decentralizzata ha davvero eseguito il calcolo richiesto?<\/h3><p class=\"wp-block-paragraph\">Dipende dal protocollo. Nella maggior parte dei marketplace GPU puri la garanzia \u00e8 solo reputazionale, cio\u00e8 ci si fida del punteggio del provider. Alcuni protocolli aggiungono meccanismi di verifica pi\u00f9 solidi, come le Trusted Execution Environment, le prove a conoscenza zero, o garanzie economiche basate su staking e penalit\u00e0. Questo tema si chiama verifiable compute, \u00e8 distinto dalla semplice decentralizzazione del calcolo, ed \u00e8 approfondito in un articolo dedicato di HOGE Wire.<\/p><h3 class='wp-block-heading'>Come vengono tassati in Italia i guadagni di chi fornisce GPU o mette token in staking su queste reti?<\/h3><p class=\"wp-block-paragraph\">Le ricompense ricevute in token, per esempio TAO o AKT, sono considerate reddito diverso e tassate al momento dell&#8217;incasso, al controvalore in euro, con l&#8217;aliquota del 33% in vigore dal 2026 e senza franchigia. Se il token viene poi rivenduto a un prezzo pi\u00f9 alto rispetto al valore gi\u00e0 tassato al momento della ricezione, la plusvalenza ulteriore viene tassata di nuovo, separatamente, come guadagno in conto capitale.<\/p><script type='application\/ld+json'>{\"@context\":\"https:\/\/schema.org\",\"@type\":\"FAQPage\",\"mainEntity\":[{\"@type\":\"Question\",\"name\":\"Cos'\u00e8 l'inferenza AI decentralizzata?\",\"acceptedAnswer\":{\"@type\":\"Answer\",\"text\":\"\u00c8 l'esecuzione di un modello di intelligenza artificiale gi\u00e0 addestrato, per generare testo, immagini o previsioni, su una rete distribuita di GPU indipendenti, coordinata da un protocollo blockchain e da un token, invece che su un singolo cloud centralizzato come AWS, Google Cloud o Microsoft Azure. Il training del modello, cio\u00e8 la fase di addestramento vera e propria, resta invece un processo molto pi\u00f9 difficile da decentralizzare per via dei vincoli di sincronizzazione tra le GPU.\"}},{\"@type\":\"Question\",\"name\":\"Qual \u00e8 la differenza tra Bittensor e un marketplace GPU come Akash o io.net?\",\"acceptedAnswer\":{\"@type\":\"Answer\",\"text\":\"Akash e io.net funzionano come un mercato dell'affitto: chi ha hardware lo mette a disposizione, chi ne ha bisogno lo affitta, e il prezzo si forma tramite un meccanismo simile a un'asta. Bittensor invece premia chi produce il miglior output secondo una metrica di qualit\u00e0 giudicata da altri partecipanti della rete, i validator, non semplicemente chi mette a disposizione pi\u00f9 hardware: \u00e8 un mercato della qualit\u00e0 del lavoro svolto, non solo della capacit\u00e0 di calcolo grezza.\"}},{\"@type\":\"Question\",\"name\":\"L'inferenza decentralizzata costa davvero meno di OpenAI o di un cloud come AWS?\",\"acceptedAnswer\":{\"@type\":\"Answer\",\"text\":\"Dipende dal carico di lavoro. Per modelli open source di dimensioni medio piccole e carichi tolleranti a una latenza variabile, i marketplace decentralizzati possono offrire prezzi competitivi grazie alla concorrenza tra provider. Per i modelli di punta pi\u00f9 recenti, con requisiti di affidabilit\u00e0 di livello enterprise, il confronto \u00e8 meno netto: le API centralizzate hanno abbassato molto i prezzi negli ultimi anni e restano spesso pi\u00f9 semplici da integrare.\"}},{\"@type\":\"Question\",\"name\":\"Come si fa a sapere se una rete decentralizzata ha davvero eseguito il calcolo richiesto?\",\"acceptedAnswer\":{\"@type\":\"Answer\",\"text\":\"Dipende dal protocollo. Nella maggior parte dei marketplace GPU puri la garanzia \u00e8 solo reputazionale, cio\u00e8 ci si fida del punteggio del provider. Alcuni protocolli aggiungono meccanismi di verifica pi\u00f9 solidi, come le Trusted Execution Environment, le prove a conoscenza zero, o garanzie economiche basate su staking e penalit\u00e0. Questo tema si chiama verifiable compute, \u00e8 distinto dalla semplice decentralizzazione del calcolo, ed \u00e8 approfondito in un articolo dedicato di HOGE Wire.\"}},{\"@type\":\"Question\",\"name\":\"Come vengono tassati in Italia i guadagni di chi fornisce GPU o mette token in staking su queste reti?\",\"acceptedAnswer\":{\"@type\":\"Answer\",\"text\":\"Le ricompense ricevute in token, per esempio TAO o AKT, sono considerate reddito diverso e tassate al momento dell'incasso, al controvalore in euro, con l'aliquota del 33% in vigore dal 2026 e senza franchigia. Se il token viene poi rivenduto a un prezzo pi\u00f9 alto rispetto al valore gi\u00e0 tassato al momento della ricezione, la plusvalenza ulteriore viene tassata di nuovo, separatamente, come guadagno in conto capitale.\"}}]}<\/script><p class=\"wp-block-paragraph\">A cura della redazione di HOGE Wire.<\/p>","protected":false},"excerpt":{"rendered":"<p>L&#8217;inferenza decentralizzata sposta l&#8217;esecuzione dei modelli AI da AWS e Google Cloud a reti come Bittensor, Akash e Ritual. Ecco come funziona, chi la usa davvero e quali rischi comporta oggi.<\/p>\n","protected":false},"author":5,"featured_media":196,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[13],"tags":[],"class_list":["post-195","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai-crypto"],"_links":{"self":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/posts\/195","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/users\/5"}],"replies":[{"embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/comments?post=195"}],"version-history":[{"count":0,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/posts\/195\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/media\/196"}],"wp:attachment":[{"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/media?parent=195"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/categories?post=195"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/hoge.gg\/it\/wp-json\/wp\/v2\/tags?post=195"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}