Nextcraft
Back to catalog

AI Safety & Governance Lead

Ensure AI systems are aligned, auditable, and compliant. Lead red-teaming, bias audits, incident response, and governance documentation.

14 competencies1 mastered2 in progressTarget roles: Alignment, audit, policy, risk

Alignment Fundamentals

In progress

RLHF, DPO, and constitutional AI approaches to value alignment.

52%

Red Teaming Methodologies

Available

Adversarial prompting, automated red-team suites, and vulnerability disclosure.

Model Card Authoring

MasteredMicrocredential · 90

Documenting capabilities, limitations, intended use, and known failure modes.

Microcredential earned

Bias Auditing

In progress

Disparate impact testing across demographics and protected attributes.

30%

AI Policy Frameworks

Available

NIST AI RMF, EU AI Act, and ISO/IEC 42001 compliance mapping.

Risk Taxonomy & Classification

Available

Harm severity scales, likelihood scoring, and risk register maintenance.

Interpretability Techniques

Locked

Attention probing, activation patching, and circuit analysis.

Incident Response for AI

Locked

Detection, containment, root-cause analysis, and postmortem for AI failures.

Data Provenance & Lineage

Available

Training data tracking, consent management, and deletion workflows.

Jailbreak & Prompt Injection Defense

Available

Input sanitization, instruction hierarchy, and indirect injection mitigation.

Model Monitoring in Production

Locked

Drift detection, output distribution tracking, and alerting thresholds.

Privacy-Preserving ML

Locked

Differential privacy, federated learning, and synthetic data generation.

Governance Documentation

Available

Audit trails, decision logs, and accountability matrices for AI systems.

Stakeholder Communication

Available

Translating technical risk findings for executives, regulators, and users.