전체 System Prompt를 카테고리별로 나열하고, 각 SP가 자신의 목적을 얼마나 완전하고 견고하게 수행하는지를 정량적으로 평가합니다. K-Law · SP-01 · v15.1을 완성도 100%의 기준점으로 두고, 다른 SP를 K-Law와 같은 복잡도로 요구하는 것이 아니라 "자신의 목적을 K-Law가 자신의 목적을 수행하는 것과 같은 수준의 엄밀함·근거·자기검증으로 수행하는가"를 기준으로 채점합니다. 아직 전체 2,011개 중 1건만 시범 평가되었으며, 카테고리를 눌러 세부 항목을 펼치거나 검색해서 살펴볼 수 있습니다.
prompts/sp-status.json에 항목을 추가하는 방식으로 카테고리(550개)·SP(2,011개) 전체를 순차적으로 채울 예정이며,
평가 기준의 가중치·세부 문구는 검토 후 조정될 수 있습니다. 조회는 누구나 가능하며, 평가 기준이나 배점에 대한 이견은 GitHub Issue로 남겨 주세요.