Vai al contenuto
Torna allo scaffale

Sette problemi costosi.

Prefazione · Il problema

Sette problemi costosi.

La parte costosa non è mai il lavoro. È il ritardo, il rifacimento e la decisione presa senza il numero.

Il problema

Ogni problema sullo scaffale qui sopra ha la stessa forma. Qualcosa che dovrebbe richiedere un pomeriggio richiede una settimana; qualcosa che dovrebbe essere verificabile viene preso per buono; e una decisione che costerà denaro vero viene presa prima che arrivi la cifra che dovrebbe informarla. Nulla di tutto ciò compare come voce di costo, ed è esattamente per questo che dura.

Tempo qualificato speso ad assemblare, non a decidere

Un responsabile finanziario che passa la prima settimana di ogni mese a riconciliare quattro sistemi è la pipeline di dati più costosa dell’azienda, e la meno mantenuta.

Decisioni prese prima che arrivi il numero

Quando il pacchetto arriva dopo la riunione, la decisione è stata presa a intuito e il reporting è diventato il verbale di ciò che è già successo anziché un input per ciò che succederà.

Numeri che nessuno è disposto a difendere

Una cifra che due reparti calcolano in modo diverso è peggio di nessuna cifra: se ne discute invece di agire, e la discussione torna ogni mese.

La clausola trovata dopo il rinnovo

Documenti letti da una persona sola, sotto pressione, producono omissioni che riemergono come costo mesi dopo — senza alcuna traccia del perché quel documento sia stato trattato così.

Come si svolge un incarico

Quattro fasi, ognuna delle quali termina con qualcosa di concreto e non con un aggiornamento di stato.

Processo · 01

Guardiamo la decisione vera e i dati veri, e concordiamo cosa sarebbe un buon risultato prima di costruire qualsiasi cosa. Spesso è qui che un progetto diventa più piccolo.

Discovery
Una definizione scritta del problema e un parere onesto se valga la pena farlo.

Processo · 02

Un flusso, un tipo di documento, una previsione. Abbastanza piccolo perché scoprire che non funziona sia una risposta economica e non un costo affondato.

Pilota delimitato
Un prototipo funzionante e una valutazione sui vostri dati.

Processo · 03

Ciò che è sopravvissuto al pilota viene costruito dove il lavoro avviene davvero, con il passaggio di revisione presente dal primo giorno anziché aggiunto dopo.

Consegna
Il flusso in produzione, la sua documentazione e i controlli che mostrano quando si degrada.

Processo · 04

Il vostro team lo gestisce senza di me. Questo include sapere come rivalutarlo quando gli input cambiano, perché cambieranno.

Passaggio di consegne
Documentazione, impianto di valutazione e una sessione con chi lo prenderà in carico.

Che aspetto ha il lavoro quando lo verifichi

Tre cose che posso mostrarti invece di affermarle. Ognuna rimanda all’artefatto e ai numeri che ci stanno dietro, compreso dove non arrivano.

Evaluation set29 claims

Metodo
Environmental claims extracted from corporate communications and rated for greenwashing risk by human reviewers, forming the reference set the detector is scored against. Human expert ratings collected via a structured questionnaire, then used as ground truth.
Al
2026-01-29
Limiti
Twenty-nine items is a small evaluation set. Every figure derived from it carries wide uncertainty and none of it should be read as a population estimate.

Prove

Krippendorff's α0.69

Metodo
Agreement between the human raters who produced the reference ratings. Krippendorff's alpha across raters; pairwise agreement ≈ 0.852.
Al
2026-01-29
Limiti
α = 0.69 is substantial but not strong agreement: the humans themselves disagree on roughly a third of the signal, which caps how well any model can be expected to match them.

Prove

Pearson r (v1)0.906

Metodo
Correlation between the v1 detector score and the human reference rating, over the 29-claim set. Pearson correlation on continuous scores. Spearman 0.811, Kendall 0.627, MAE 0.206, RMSE 0.237.
Confrontato con
v3 rule-based detector, r = 0.793; v2 semantic detector, r = 0.557.
Al
2026-01-29
Limiti
Correlation on 29 items. It says the score moves with reviewer judgement, not that the score is calibrated as a probability of greenwashing.

Prove

Recall / precision (v3)0.40 recall at 1.00 precision

Metodo
Binary flag / no-flag performance of the v3 rule-based detector against the human reference labels. Thresholded score compared with binarised human labels on the same 29-claim set.
Confrontato con
v1 baseline: recall 0.15 at precision 1.00 (F1 0.261). v3 reaches F1 0.571.
Al
2026-01-29
Limiti
Recall of 0.40 means roughly three in five flaggable claims are missed. Precision of 1.00 on a set this small is a handful of correct positives, not a guarantee. The tool is a reviewer aid; it cannot be a filter that runs unattended.

Quale decisione o processo stai cercando di migliorare?

Bastano poche frasi. Rispondo personalmente, di solito entro un paio di giorni lavorativi, e dico apertamente se non è qualcosa di cui dovrei occuparmi io.

Parliamo del tuo progetto
100%

Trascina la pagina per voltarla · Trascina la lente sul foglio

Nulla in questo sito è consulenza contabile, di revisione, fiscale, legale o in materia di investimenti, e nessuna cifra qui è una promessa di risultato. Dove compare un numero, compaiono con esso la sua fonte e i suoi limiti.