Costi del solare in Brasile su del 7%, i calcolatori dei prezzi di inferenza finiscono sullo stesso foglio
I prezzi medi dei sistemi fotovoltaici in Brasile sono saliti del 7% nella prima metà del 2026 per gli impianti fino a 300 kW. Lo rileva lo studio Distributed Energy Solutions di Greener, ripreso da pv magazine il 26 settembre.

Quel numero non c'entra nulla con le GPU. Eppure finisce sulla stessa scrivania. Chi a fine settembre 2026 deve dimensionare un budget di calcolo si destreggia tra capex hardware, elettricità, tariffe API per token e un foglio di ipotesi che raramente regge il contatto con il traffico di produzione.
Due dossier usciti questo fine settimana attaccano il problema da lati opposti: quanto costano l'hardware e il sole, e quanto costano i token quando l'hardware è già in funzione.
Il dato brasiliano, nel dettaglio
Secondo pv magazine, che il 26 settembre ha ripreso lo studio Greener, l'aumento del 7% copre il periodo da gennaio a giugno 2026. I prezzi finali dei sistemi andavano da BRL 2,02 ($ 0,38) per watt per gli impianti da 30 kW e 50 kW fino a BRL 3,62/W per i sistemi da 2 kW. La media dei 2 kW è salita da BRL 3,44/W a gennaio a BRL 3,62/W a giugno, circa BRL 7.200 per l'intero impianto. Un sistema da 300 kW è costato in media BRL 2,40/W, circa BRL 720.000, e fino a circa BRL 834.000 nella versione a terra.
A spingere i prezzi sono state le apparecchiature, non la manodopera. I kit per i sistemi da 4 kW sono balzati del 18,3% tra gennaio e giugno, da BRL 1,42/W a BRL 1,68/W. Per i sistemi da 300 kW il kit è cresciuto solo del 2,0%, da BRL 1,02/W a BRL 1,04/W. Per i kit da 50 kW è passato da BRL 1,14/W a BRL 1,24/W, con un +8,8%.
Nello stesso periodo la domanda si è assottigliata. Le nuove connessioni in generazione distribuita sono calate del 16% su base annua, da 488.000 a 411.000. Il numero di nuove unità di consumo che ricevono crediti è sceso del 43%, da 951.000 a 541.000. Gli impianti residenziali hanno assorbito il 65% della capacità aggiunta, contro il 39% del 2019. Il finanziamento è comparso solo nel 33% delle vendite degli integratori, otto punti in meno e la quota più bassa del periodo analizzato. La serie storica di Greener colloca un impianto residenziale da 4 kW a BRL 7,74/W a gennaio 2017, contro BRL 2,91/W a giugno 2026.
Quanto costa davvero un token
Il 23 settembre lo sviluppatore Flavio Copes ha pubblicato un calcolatore dei costi di inferenza. Serve a stimare la bolletta mensile di una funzionalità prima che qualcuno scriva un'integrazione di fatturazione. Confronta 27 modelli di OpenAI, Anthropic, Google, xAI, Mistral, OpenRouter e Workers AI usando le tariffe API pubblicate. Poi trasforma utenti attivi giornalieri, chiamate per utente, token di input e output e un'opzionale percentuale di prompt cache in una stima.
Lo strumento è esplicito sui suoi limiti. Ignora i prezzi batch, gli sconti enterprise, i sovrapprezzi per immagini e strumenti e qualsiasi livello di cache costruito da te. Copes descrive il risultato come una stima di pianificazione, non come un preventivo di un fornitore. Tutto gira nel browser e un link condiviso codifica soltanto gli input nell'URL.
È sul divario tra prezzo di listino e costo reale che si concentrano le discussioni. Un'indagine pubblicata da Nexlab il 20 settembre mette a confronto LocalAI, exo, GPUStack, vLLM, Ollama, llama.cpp, Xinference, LiteLLM, SkyPilot e altri. Il routing consapevole della cache, osserva, determina se un turno successivo finisce dove si trovano già la sua KV cache o la sua prefix cache. Ollama, con 181.000 stelle su GitHub al 20 settembre, non ha alcuna soluzione di cluster oltre al round-robin su più URL. vLLM fa prefix caching per istanza. LocalAI ha aggiunto a giugno 2026 una modalità distribuita con discovery libp2p e un router basato su NATS che tiene conto della VRAM e delle prefix cache.
La differenza tra i due rappresenta il costo di integrazione, che include il margine tecnico e operativo dell'integratore.
Quella frase viene dalla metodologia Greener così come la descrive pv magazine. Vale allo stesso modo per l'inferenza: il kit non è la bolletta.
Anche i benchmark stanno diventando costosi
Il 26 settembre StarSkirmish ha lanciato un benchmark. Dieci LLM hanno ciascuno un'ora di tempo reale per scrivere un bot Protoss in C++ contro BWAPI 4.4.0, giocato su OpenBW. GPT-6 Astra e Claude Opus 5.5 sono descritti come funzionalmente appaiati in testa, con GPT-6 Sol subito dietro e segnalato per il rapporto qualità-prezzo rispetto al costo API medio di una corsa di un'ora.
Il campo è composto da 50 bot LLM (10 modelli, 5 corse ciascuno), 3 bot dimostrativi e 9 bot scritti da esseri umani, per 62 partecipanti. Ogni partecipante gioca contro ogni altro sei volte, due su ciascuna di tre mappe. Il rating è Elo, calcolato su tutte le partite insieme, con Stardust scalato a 100 e Four Gate Dragoon a 0. Le partite sono girate su sandbox Prime Intellect tramite OpenRouter, con sola inferenza first party. Gli organizzatori dicono di voler allungare i periodi di ragionamento, perché i modelli allo stato dell'arte traggono vantaggio da corse oltre l'ora.
Il costo di questo tipo di valutazione non è pubblicato. Nemmeno il prezzo dell'oro.
Tom's Hardware ha riportato il 27 settembre che un cliente ha ordinato un mini PC Kubb Fanless personalizzato con un telaio passivo in oro puro a 24 carati per circa $ 1.700.000, citando Fanless Tech. Il peso passa da 4,6 libbre (2,1 kg) a 28,7 libbre (13 kg). Fanless Tech indica la conduttività termica dell'oro come migliore del 30% al 50% rispetto all'alluminio. Tom's Hardware osserva che il rame sarebbe costato meno e conduce meglio il calore. La macchina di base è una scatola da 120 x 120 x 120 mm con Intel Core Ultra 5 225H, Core Ultra X7 358H o AMD Ryzen AI 5 340, listata a € 1.595 ($ 1.822) su Kubb.eu, senza disponibilità.
La parte scomoda
Nessuno di questi numeri condivide un'unità di misura. BRL per watt, dollari per milione di token, dollari per corsa di benchmark, dollari per chilogrammo d'oro. L'unico confronto che regge è che tutti e quattro stanno salendo o sono oggetto di discussione nella stessa settimana, e nessuna delle cifre pubbliche include i costi che decidono se un progetto rientra.
Per chi pianifica l'inferenza, la mossa pratica è modellare il tasso di cache hit. Il calcolatore di Copes lo tratta come opzionale e nota che almeno un fornitore non pubblica alcuno sconto sull'input in cache, quindi per quel modello il tasso di cache viene ignorato. L'indagine di Nexlab fa lo stesso punto dal lato infrastrutturale: instradare un prompt ripetuto verso una macchina che ne ha già il prefisso vale più di una GPU più economica che deve ricalcolarlo. Nessuna delle due fonti mette un numero preciso sul risparmio, e nessuna pretende di farlo. Trattale entrambe come input di pianificazione, poi misura il tuo traffico.
Fonti
5- 01PV system costs increase by 7% in Brazil in H1EN
- 02Custom 24-carat gold mini PC costs around $1.7 million, weighs nearly 29 pounds for up to 50% faster heat transferEN
- 03Inference Cost CalculatorEN
- 04StarSkirmish: a StarCraft: Brood War benchmark for LLM-written botsEN
- 05Self-hosted inference orchestrators compared: LocalAI, exo, GPUStack, Xinference, Ollama, vLLM and CoderAI (September 2026)EN
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.