daemon-blockint-tech/agentic-enteprises-skill

engineering-manager-agent-prompts-evals

Guides engineering managers leading teams that own agent prompts, tool schemas, golden eval suites, judge programs, and prompt regression CI—org design, hiring, roadmap with PM/risk, release governance, and team KPIs for eval quality and prompt stability. Use when managing prompt/eval engineers, prioritizing eval backlogs, staffing harness and judge programs, or governing prompt releases—not for writing prompts or harnesses (prompt-engineer-agent-prompts-evals), vertical AI squad management (en…

First seen May 20, 2026

Installation

$ npx skills add daemon-blockint-tech/agentic-enteprises-skill --skill engineering-manager-agent-prompts-evals

Similar popular skills

Related neighbors and high-traction skills in the same topics — useful to compare before installing.

Also in this package

Other skills from daemon-blockint-tech/agentic-enteprises-skill · top by installs.

npx skills add daemon-blockint-tech/agentic-enteprises-skill

Browse all from daemon-blockint-tech/agentic-enteprises-skill

More details

Agent compatibility

Declared targets from SKILL.md / docs. Unmarked agents are not listed — the skill may still install via the CLI.

Claude Code Not declared
Cursor Not declared
Codex Not declared
GitHub Copilot Not declared
Windsurf Not declared
Gemini CLI Not declared
Cline Not declared
OpenCode Not declared

Repository health

Stars 8
Default branch main
Open issues 0
Status Active

Package contents

Files included with this skill beyond the listing page.

  • skill md SKILL.md 3,515 B
  • docs SUMMARY.md 624 B

History

  1. First seen on skills.sh
  2. First recorded snapshot · 30 installs

SKILL.md

Engineering Manager, Agent Prompts & Evals

When to Use

  • Build or scale a prompt + eval engineering function (central or embedded)
  • Prioritize golden set, harness, and judge work with PM and risk
  • Define release policy for prompt/tool changes (gates, waivers, rollback)
  • Hire and level prompt engineers, eval engineers, and tech leads
  • Resolve capacity conflicts between new agents and eval debt
  • Report eval health (pass rate, slice regressions, judge drift) to leadership
  • Partner with ai-lead-ops on production incidents tied to prompts

When NOT to Use

  • Author system prompts, tool schemas, or eval cases → prompt-engineer-agent-prompts-evals
  • General prompt patterns (CoT, few-shot) → prompt-engineer
  • Full RAG/agent application code → ai-engineer
  • Vertical AI product roadmap and GTM launches → engineering-manager-vertical-ai-products
  • Adversarial red-team execution → ai-redteam
  • Org-wide data or analytics management → data-manager

Related skills

Need Skill
IC prompt/eval implementation prompt-engineer-agent-prompts-evals
Vertical AI EM (broader) engineering-manager-vertical-ai-products
AI ops and rollouts ai-lead-ops
Risk tier and policy ai-risk-governance
Token cost programs ai-token-improvement-plan-engineer

Core Workflows

1. Org design

Central eval platform vs embedded prompt owners; ratios and interfaces.

See references/teamorgprompt_eval.md.

2. Roadmap and prioritization

Eval debt, new agent coverage, judge calibration, CI investment.

See references/roadmap_prioritization.md.

3. Release governance

Prompt semver gates, waivers, coordination with risk and ops.

See references/release_governance.md.

4. Stakeholder partnerships

PM, applied architect, risk, red-team, platform eng.

See references/stakeholder_partnerships.md.

5. Hiring and development

Levels for prompt/eval specialists.

See references/hiring_development.md.

6. Team metrics

Pass rate, coverage, time-to-golden-case, incident linkage.

See references/teammetricsaccountability.md.

Output standards

  • Roadmap items name eval slice, prompt surface, and risk tier
  • No prompt prod change without documented baseline vs candidate
  • Waivers require risk sign-off for Tier 1–2 customer-facing agents
  • Escalations include trade-offs (scope, date, headcount)

When to load references

  • Orgreferences/teamorgprompt_eval.md
  • Roadmapreferences/roadmap_prioritization.md
  • Releasereferences/release_governance.md
  • Stakeholdersreferences/stakeholder_partnerships.md
  • Peoplereferences/hiring_development.md
  • KPIsreferences/teammetricsaccountability.md