skillrank_skill langchain-ai/eval-engineeringMIT · open registry

skill detail

← registry

Eval Engineering

langchain-ai/eval-engineering

Iteratively inspect an agent repository and optional user-provided traces, interview the user, and create, run, and audit Harbor evals one at a time. Use for agent evals, Harbor tasks, benchmark cases, verifier design, or controlled agent environments.

communityprovisionalstylingiterativelyinspectagent

skillrank score

██████░░░░░░░░░░40

SkillRank score blends community stars, real usage, and our eval lift; provisional until a skill is evaluated -- so popularity alone can't reach the top tier.

source

1.1k

langchain-ai/langchain-skills

config/skills/eval-engineering

open on GitHub ▸

eval status

eval pending

Success delta, token delta, and trial count are not available yet. No eval number is shown until this skill has measured results.

install

$ skillrank install langchain-ai/eval-engineering
$ curl -fsSL skillrank.dev | sh