İçeriğe geç
Rafa dön

Yedi pahalı problem.

Ön söz · Problem

Yedi pahalı problem.

Pahalı olan asla işin kendisi değildir. Gecikme, yeniden yapım ve sayı olmadan verilen karardır.

Problem

Yukarıdaki raftaki her problem aynı biçime sahip. Bir öğleden sonra sürmesi gereken bir iş bir hafta sürüyor; denetlenebilir olması gereken bir şey güvene dayanıyor; ve gerçek para maliyeti olan bir karar, onu besleyecek rakam gelmeden veriliyor. Bunların hiçbiri bir gider kalemi olarak görünmez — tam da bu yüzden sürer.

Karar vermeye değil, derlemeye harcanan nitelikli zaman

Her ayın ilk haftasını dört sistemi mutabakata getirerek geçiren bir finans yöneticisi, şirketteki en pahalı ve en bakımsız veri hattıdır.

Sayı gelmeden verilen kararlar

Rapor toplantıdan sonra masaya geldiğinde karar sezgiyle verilmiştir; raporlama da bundan sonra ne olacağının girdisi değil, çoktan olanın kaydı hâline gelir.

Kimsenin arkasında duramayacağı sayılar

İki departmanın farklı hesapladığı bir rakam, hiç rakam olmamasından kötüdür: üzerinde işlem yapılmak yerine tartışılır ve tartışma her ay tekrarlanır.

Yenilendikten sonra bulunan madde

Zaman baskısı altında tek kişi tarafından okunan belgeler, aylar sonra maliyet olarak ortaya çıkan atlamalar üretir — üstelik o belgenin neden öyle değerlendirildiğine dair hiçbir kayıt olmadan.

Bir iş nasıl yürüyor

Dört aşama; her biri bir durum güncellemesiyle değil, elinize geçen bir çıktıyla bitiyor.

Süreç · 01

Asıl karara ve asıl veriye bakarız; hiçbir şey inşa edilmeden önce iyi bir sonucun ne olacağını kararlaştırırız. Projeler çoğu zaman burada küçülür.

Keşif
Yazılı bir problem tanımı ve yapmaya değip değmeyeceğine dair dürüst bir görüş.

Süreç · 02

Tek iş akışı, tek belge türü, tek tahmin. İşe yaramadığını öğrenmenin batık maliyet değil, ucuz bir cevap olacağı kadar küçük.

Sınırlanmış pilot
Çalışan bir prototip ve kendi verileriniz üzerinde bir değerlendirme.

Süreç · 03

Pilotu geçen şey, işin gerçekten yapıldığı yerde kurulur; inceleme adımı sonradan eklenmek yerine ilk günden yerindedir.

Teslim
Devreye alınmış iş akışı, dokümantasyonu ve ne zaman saptığını gösteren kontroller.

Süreç · 04

Ekibiniz onu bensiz çalıştırır. Buna, girdiler değiştiğinde nasıl yeniden değerlendirileceğini bilmek de dâhildir; çünkü değişecekler.

Devir
Dokümantasyon, değerlendirme düzeneği ve sonraki sahibiyle bir gözden geçirme.

Denetlediğinizde çalışma neye benziyor

İddia etmek yerine gösterebileceğim üç şey. Her biri, eksik kaldıkları yerler dâhil olmak üzere arkasındaki ürüne ve sayılara bağlanıyor.

Evaluation set29 claims

Yöntem
Environmental claims extracted from corporate communications and rated for greenwashing risk by human reviewers, forming the reference set the detector is scored against. Human expert ratings collected via a structured questionnaire, then used as ground truth.
Tarih
2026-01-29
Sınırlar
Twenty-nine items is a small evaluation set. Every figure derived from it carries wide uncertainty and none of it should be read as a population estimate.

Kanıt

Krippendorff's α0.69

Yöntem
Agreement between the human raters who produced the reference ratings. Krippendorff's alpha across raters; pairwise agreement ≈ 0.852.
Tarih
2026-01-29
Sınırlar
α = 0.69 is substantial but not strong agreement: the humans themselves disagree on roughly a third of the signal, which caps how well any model can be expected to match them.

Kanıt

Pearson r (v1)0.906

Yöntem
Correlation between the v1 detector score and the human reference rating, over the 29-claim set. Pearson correlation on continuous scores. Spearman 0.811, Kendall 0.627, MAE 0.206, RMSE 0.237.
Karşılaştırıldığı
v3 rule-based detector, r = 0.793; v2 semantic detector, r = 0.557.
Tarih
2026-01-29
Sınırlar
Correlation on 29 items. It says the score moves with reviewer judgement, not that the score is calibrated as a probability of greenwashing.

Kanıt

Recall / precision (v3)0.40 recall at 1.00 precision

Yöntem
Binary flag / no-flag performance of the v3 rule-based detector against the human reference labels. Thresholded score compared with binarised human labels on the same 29-claim set.
Karşılaştırıldığı
v1 baseline: recall 0.15 at precision 1.00 (F1 0.261). v3 reaches F1 0.571.
Tarih
2026-01-29
Sınırlar
Recall of 0.40 means roughly three in five flaggable claims are missed. Precision of 1.00 on a set this small is a handful of correct positives, not a guarantee. The tool is a reviewer aid; it cannot be a filter that runs unattended.

Hangi kararı veya iş akışını iyileştirmeye çalışıyorsunuz?

Problemi birkaç cümleyle anlatın. Yanıtları bizzat ben yazıyorum, genelde birkaç iş günü içinde; üstlenmemem gereken bir işse bunu açıkça söylerim.

Projenizi konuşalım
100%

Çevirmek için sayfayı sürükleyin · Büyüteci üzerinde gezdirin

Bu sitedeki hiçbir şey muhasebe, denetim, vergi, hukuk veya yatırım tavsiyesi değildir ve buradaki hiçbir rakam bir sonuç vaadi değildir. Bir sayı görünüyorsa, kaynağı ve sınırları da onunla birlikte görünür.