Paolo Bietolini

Home | Feed Atom

DDIA: Capitolo 1 — Applicazioni affidabili, scalabili e manutenibili

Questi appunti fanno parte di un progetto di Learn in Public. Ogni settimana leggo e riassumo un capitolo di Designing Data-Intensive Applications di Martin Klepmann. Gli appunti sono presi in inglese e tradotti in Italiano da Claude. Contestualmente al libro sto lavorando ad un progetto di creazione ed ingestion di …

A NaN where a Long should be

A PySpark TypeError that looked like a schema bug was actually three steps upstream. Pandas can’t represent what BigQuery hands it, (nested structs, nullable integers, timezone-aware timestamps, arbitrary-precision numerics) so every downstream line is a patch against a loss that happened at the moment pandas entered …

Arrow over the wire

Four lines of Spark config to read BigQuery. Underneath: a gRPC read session, one stream per Spark partition, Arrow end-to-end, server-side column and filter pushdown, and dynamic rebalancing when executors finish early. A walkthrough of what those lines actually trigger — and why the middle format isn’t replaced with …

Problemi con il form listener per Elementor

Come il listener per i form di Elementor blocca la Consent Mode ovvero sul perché non copincollare gli script da Internet Per un cliente con Elementor ho integrato uno script trovato online per tracciare gli invii dei form dal suo sito. E mi ha causato due settimane di mal di testa. Ora, prendiamoci la manina e seguimi …