marielynneblock/arcanum-artifex · skills/agentic/agentic-eval/SKILL.md

agentic-eval skillA

Use when designing and implementing evaluation loops for AI agents, including reflection, evaluator-optimiser patterns, rubric scoring, LLM-as-judge review, test-driven refinement, convergence checks, and iteration logging.

Latest version
mdr add marielynneblock/arcanum-artifex/agentic-eval@git:20260624.0a2f9fa
Exact content
mdr add marielynneblock/arcanum-artifex/agentic-eval@sha256:1b41a4e8a4e33ab1
Badge

mdr badge

[![mdr](https://markdownregistry.com/badge/art_kvvbfexztdka7gug.svg)](https://markdownregistry.com/a/art_kvvbfexztdka7gug)

0 badge views in 30 days

Versions

versioncommittedcommitsizeaudit
git:20260624.0a2f9fa latest2026-06-24 0a2f9fa 10,924 BA view · diff
git:20260520.f6c6e912026-05-20 f6c6e91 8,848 BA view · diff
git:20260515.b861afb2026-05-15 b861afb 5,525 BB view · diff
git:20260510.f26bcec2026-05-10 f26bcec 5,940 BA view

Audit of the latest version

A  17 of 17 checks passed. Deterministic, no model, same answer every run.

Source

GitHub

marielynneblock/arcanum-artifex · 4 stars · license none · pushed 2026-09-05 · branch main

API

GET https://markdownregistry.com/api/v1/artifacts/art_kvvbfexztdka7gug
GET https://markdownregistry.com/api/v1/resolve?ref=marielynneblock/arcanum-artifex/agentic-eval
GET https://markdownregistry.com/api/v1/blob/1b41a4e8a4e33ab1220495db4f480d7771840f3de75ee411faba116a7853ab34