OMK — Observe. Measure. Know. Make every knowledge change in your AI application evidence-backed.
benchmark ai evaluation-framework claude knowledge-engineering skill-evaluation llm prompt-engineering prompt-testing llm-evaluation rag-evaluation llm-judge claude-code agent-evaluation bootstrap-ci krippendorff-alpha evaluation-as-code multi-judge-ensemble
-
Updated
Jul 29, 2026 - TypeScript