jasoncolapietro/suede-creator-skills · skills/suede-ai-eval/SKILL.md

suede-ai-eval skillA

Suede Labs AI eval design and coverage audit: AI-SPEC, failure-mode rubric with severity scoring, concrete pass/fail eval cases, coverage and infrastructure scores, and mechanical acceptance gates. Use when a change ships LLM, RAG, agent, classifier, prompt, or generated-media behavior, or when asked to write evals for an AI feature, design test cases for a model surface, audit existing eval coverage, or judge whether AI behavior is safe to ship. No AI-SPEC means no eval plan, and no eval plan h

Latest version
mdr add jasoncolapietro/suede-creator-skills/suede-ai-eval@git:20260815.1163506
Exact content
mdr add jasoncolapietro/suede-creator-skills/suede-ai-eval@sha256:929d1b8df2c35ee4
Badge

mdr badge

[![mdr](https://markdownregistry.com/badge/art_oz7lq4epucgqhgvw.svg)](https://markdownregistry.com/a/art_oz7lq4epucgqhgvw)

0 badge views in 30 days

Versions

versioncommittedcommitsizeaudit
git:20260815.1163506 latest2026-08-15 1163506 13,277 BA view · diff
git:20260810.7f07d062026-08-10 7f07d06 12,211 BA view · diff
git:20260804.831214b2026-08-04 831214b 22,595 BA view · diff
git:20260720.33ebb142026-07-20 33ebb14 22,597 BA view · diff
git:20260720.aeaa4162026-07-20 aeaa416 21,334 BA view

Audit of the latest version

A  17 of 17 checks passed. Deterministic, no model, same answer every run.

Source

GitHub

jasoncolapietro/suede-creator-skills · 130 stars · license MIT · pushed 2026-09-05 · branch main

API

GET https://markdownregistry.com/api/v1/artifacts/art_oz7lq4epucgqhgvw
GET https://markdownregistry.com/api/v1/resolve?ref=jasoncolapietro/suede-creator-skills/suede-ai-eval
GET https://markdownregistry.com/api/v1/blob/929d1b8df2c35ee4d3e854db853b0ed659ab2bfd19c58849857abd787ee5d5f5