Vai al contenuto
Ora nel mondoEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portale su IA e tecnologiaeventi · analisi · interviste · approfondimenti tecnici

Cerca
LIVE
›

Lo stack dei dati sportivi viene ricostruito in silenzio: cosa dicono davvero le ultime 72 ore

Il 30 settembre Tigris ha pubblicato un post-mortem su come ha spostato la coda dell'object storage dentro FoundationDB e il lavoro asincrono su Kafka. Non è una storia di sport, ma descrive esattamente le condutture che oggi trasportano i media sportivi ad alto volume, ed esce nella stessa settimana in cui ai data centre europei è stato detto che non possono tenere segreti i numeri su acqua ed elettricità.

SportAnalisiLuca EspositoPubblicato: 30 settembre 20266 min di letturaFonti 6
Lo stack dei dati sportivi viene ricostruito in silenzio: cosa dicono davvero le ultime 72 ore

La cosa più utile pubblicata sulla tecnologia sportiva nelle ultime 72 ore non ha nulla a che fare con lo sport. Il 30 settembre il fornitore di object storage Tigris ha pubblicato un post-mortem di ingegneria che spiega perché ha spostato attività asincrone come la garbage collection fuori da FoundationDB e su Kafka. Il motivo conta per chiunque gestisca analisi sportive: se un worker muore a metà lavoro, il lavoro muore con lui. "Una volta che il worker consuma un job, questo non è più in coda e il job muore con lui", ha scritto l'azienda.

Lo sport oggi è un mucchio esattamente di questi job. Feed di tracking, pipeline video, regolamento delle scommesse, rendering degli highlight. Niente di tutto questo tollera un messaggio perso.

Tigris non nasconde il compromesso. Tiene ancora alcune code dentro FoundationDB, perché il database elimina il problema della doppia scrittura, ma la pianificazione "richiede molte scritture e scansioni, il che mette carico in lettura su FoundationDB che compete direttamente con le richieste degli utenti". L'azienda ha implementato il paper QuiCK di Apple, il sistema di accodamento dietro CloudKit, e lo descrive come "un sistema di accodamento che usa il Record Layer di FoundationDB per implementare una coda di messaggi basata sul tempo". Il pezzo è anche insolitamente divertente su Kafka: paragona l'auto-hosting al risvegliarsi come "un parassita mostruoso" mentre tutti con cortesia ti chiedono di andare avanti con la vita.

Il collegamento con lo sport non è forzato. Leghe e broadcaster hanno passato un decennio a promettere una copertura data-native, e il discorso di solito si ferma alla dashboard. Il sottoclasso è l'orchestrazione: quali eventi vengono elaborati, in quale ordine, e cosa succede quando un worker cade alle 3 di notte durante una partita.

I data centre europei tacciono sui numeri

Lo stesso giorno il quotidiano olandese NL Times ha riportato i risultati di un'indagine durata un anno di Lighthouse Report con Trouw e altri media europei sulla rendicontazione ambientale dei data centre. Il risultato è netto: nei Paesi Bassi meno di un quarto dei data centre più grandi pubblica cifre su elettricità e acqua potabile consumate.

I numeri dietro quel vuoto sono precisi. Secondo la Dutch Datacenter Association, alla fine dell'anno scorso nei Paesi Bassi c'erano 186 data centre commerciali con una capacità di 500 kilowatt o più. L'Agenzia delle imprese olandese, che raccoglie i dati per l'UE, ha registrazioni solo su 104 di essi, e esistono cifre pubbliche per il consumo elettrico di 44 centri e per l'acqua di 47. La direttiva europea sull'efficienza energetica richiede la rendicontazione a quella soglia da tre anni.

Statistics Netherlands stima il consumo elettrico dei data centre olandesi a 5,1 miliardi di kilowattora nel 2024, il 4,6 per cento del consumo nazionale e quasi il doppio rispetto a cinque anni prima. L'operatore di rete TenneT prevede dal 10 al 15 per cento entro il 2030. L'RVO ha rivelato quest'estate che il più grande data centre olandese di Microsoft da solo vale l'1 per cento del consumo elettrico nazionale. Google, che gestisce due grandi data centre nel paese, non divulga le sue cifre.

Per lo sport non è astratto. Streaming, tracking in tempo reale e computer vision stanno tutti sulla stessa rete, e nello stesso punto cieco della rendicontazione.

Interrogare il lake senza spostarlo

Sempre il 30 settembre AWS ha annunciato che Aurora PostgreSQL può ora interrogare direttamente dati Apache Iceberg e Parquet, tramite foreign table, usando il motore di query di DuckDB integrato in PostgreSQL. L'azienda dice che la funzionalità è disponibile in generale su Aurora PostgreSQL a partire dalle versioni 17.11 e 18.6 in tutte le regioni commerciali e GovCloud, senza costi aggiuntivi.

La promessa è l'eliminazione dell'ETL. "Accedervi ha tipicamente richiesto pipeline che copiano i dati dal data lake in Aurora, facendo salire costi e lavoro di ingegneria man mano che gli schemi evolvono", si legge nell'annuncio. Per un'organizzazione sportiva è la differenza tra un data lake che resta in un magazzino e uno che un analista può davvero interrogare durante una stagione.

Club e leghe hanno promesso ecosistemi sportivi data-native agli eventi di settore per tutta la settimana. Consultancy-me.com ha seguito il 29 settembre un dirigente di Pure Sports che parlava proprio di questo a LEAP 2026, e SVG Europe ha pubblicato lo stesso giorno un pezzo sull'infrastruttura per i media ad alto volume. Nessuno dei due è il lancio di un prodotto. Entrambi descrivono un mercato che dà per scontato che il livello dei dati funzioni.

Sempre più spesso funziona. Questa è la storia.

Anche il livello della ricerca si muove

Il 29 settembre i ricercatori Osayamen Jonathan Aimuyo, Swapnil Gandhi e Christos Kozyrakis hanno inviato ad arXiv un paper che descrive Purlin, un framework di comunicazione che separa l'orchestrazione dal datapath nei collettivi GPU. Il paper riporta velocizzazioni della latenza fino a 5,14 volte e miglioramenti di banda fino a 4,50 volte su sette collettivi su GPU A100, H200 e B200. Integrato nello stack di serving SGLang, Purlin ha migliorato il throughput e l'interattività del serving LLM offline di 1,13 volte in media e fino a 1,37 volte, e l'interattività dell'inferenza online di 1,26 volte in media e fino a 2,85 volte, con il guadagno maggiore sotto sovraccarico.

Non sono benchmark sportivi. Ma i carichi di lavoro hanno la stessa forma della generazione automatica di highlight, del tracking multi-camera e dell'inferenza tattica in tempo reale, dove la latenza sotto carico è tutto il prodotto.

Il divario tra un guadagno di interattività di 2,85 volte in un paper e un sistema funzionante a bordo campo è enorme, e nulla nel dossier suggerisce che qualcuno l'abbia colmato. La direzione di marcia però è coerente in ogni fonte pubblicata questa settimana: il lavoro interessante avviene sotto l'interfaccia, nell'orchestrazione, nei motori di query e nei collettivi di rete.

Cosa la settimana non ha risolto

Non ha risolto la privacy. Il 30 settembre 404 Media ha riportato che l'amministrazione Trump sta usando il programma High Intensity Drug Trafficking Area degli anni Ottanta per convogliare i dati locali dei lettori automatici di targhe di Flock, Axon e altri fornitori nei centri di sorveglianza federali, e in alcuni casi fino al National License Plate Reader Program della DEA. I documenti sono stati ottenuti tramite richieste di accesso agli atti pubblici da Cris van Pelt, creatore di HaveIBeenFlocked.com. Jeramie Scott dell'Electronic Privacy Information Center ha detto a 404 Media: "Se siete arrabbiati per Flock, dovreste essere arrabbiati per questo."

Gli impianti sportivi fanno parte di quel parco di telecamere. Così come i parcheggi intorno a essi.

Non ha risolto nemmeno i dati sanitari. Il Guardian ha riportato il 30 settembre che più di 44.000 persone hanno presentato obiezioni formali ai sensi dell'articolo 21 del GDPR britannico contro la gestione dei loro dati da parte della Federated Data Platform di NHS England, basata su Palantir, con i campagne che citano il lavoro di Palantir per l'esercito israeliano e per l'applicazione delle leggi sull'immigrazione negli Stati Uniti. Palantir dice che la piattaforma aiuta a ridurre le liste d'attesa, citando 117.000 interventi aggiuntivi, una riduzione del 14,3 per cento dei ritardi di dimissione per i pazienti di lunga degenza e un miglioramento del 5,6 per cento nella diagnosi di cancro entro 28 giorni.

E non ha risolto la questione ambientale. L'indagine di Lighthouse Report ha scoperto che i data centre europei in gran parte non dicono quanto consumano in acqua ed elettricità, tre anni dopo l'inizio dell'obbligo di rendicontazione.

Messe insieme, le ultime 72 ore descrivono un settore della tecnologia sportiva il cui livello visibile, le dashboard, la grafica di tracking, il commento AI, gira su un livello invisibile che viene ricostruito in blog di ingegneria pubblici e preprint su arXiv, mentre i suoi costi in risorse e privacy restano in gran parte non dichiarati. Non è uno scandalo. È un problema di misurazione, ed è quello che vale la pena osservare.

Commenti 0

Fonti

6
  1. 01We used a database as a message queue. Now we use Kafka.EN
  2. 02Most data centers refusing to say how much water, electricity they useEN
  3. 03Aurora PostgreSQL now supports querying of Apache Iceberg and Parquet dataEN
  4. 04Purlin: Separating Orchestration from the Datapath of CollectivesEN
  5. 05How Cities Are Forced to Funnel License Plate Data to a Massive Federal Surveillance ProgramEN
  6. 06More than 44,000 file legal objections to Palantir NHS platform handling their dataEN

Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.

I contenuti sono stati preparati dalla redazione con il supporto dell'IA.

Luca Esposito

Luca Esposito

Sport, auto e viaggi

Luca Esposito si occupa di sport, auto e viaggi per FLASH24, con un metodo basato su fonti dirette: comunicati ufficiali, cronometraggi e dati tecnici delle case automobilistiche. Per le gare verifica tempi e distacchi sulle classifiche federali, mentre per i veicoli confronta schede tecniche e consumi omologati. Sente regolarmente meccanici, piloti e addetti stampa, e in calendario attende i saloni dell'auto e le grandi corse a tappe. Segue anche auto elettriche, riparazioni in garage e tratte ferroviarie europee, temi che ritornano spesso nei suoi articoli. Non pubblica numeri o anteprime senza una seconda conferma indipendente.

Redazione →

Commenti

0
  1. Nessun commento — sii il primo.

Scrivi un commento

I commenti sono pubblici. Non pubblichiamo insulti, spam né pubblicità.