Backend · Platform · AI Infrastructure

Complex systems rarely fail for obvious reasons.

I build tools that make their behavior observable, measurable and actionable.

Open to backend, platform, reliability and production engineering roles
SYSTEM FAILURE OBSERVATORYLIVE / RUN #287
NOMINAL
RequestHEALTHY
AgentGridHEALTHY
FaultlineHEALTHY
KubePulseHEALTHY
FairEvalHEALTHY
DetTraceHEALTHY
ReleaseHEALTHY
RESETREADY