ooligo
claude-skill

Einen KI-Interview-Stack gegen US-Beschäftigungsregeln für KI prüfen

Difficulty
Profi
Setup time
90min
For
talent-acquisition · recruiter · legal-ops-manager
Recruiting & TA

Stack

Ein Claude Skill, der Ihre Stellenliste, Ihr Tool-Verzeichnis und Ihr Nachweispaket entgegennimmt und eine Kontrollmatrix zurückgibt: welche KI-Beschäftigungspflichten für welche Stelle gelten, welche Kontrollen Sie tatsächlich belegen können und welche Lücken täglich Bußgelder aufbauen. Bewertet wird anhand der Artefakte, die Sie liefern — eine veröffentlichte Bias-Audit-URL, ein Export der Einwilligungs-Timestamps, ein Löschungs-Runbook — nicht anhand von Vendor-Aussagen, und ein Urteil “konform / nicht konform” gibt der Skill nie ab. Das Ergebnis ist das, was Sie der Rechtsabteilung übergeben, damit deren erste Stunde bei den Ermessensfragen beginnt statt bei “welche Tools nutzen Sie, und wo?”

Wann Sie ihn einsetzen

  • Sie schalten einen KI-Interviewer, ein KI-Video-Screening oder Lebenslauf-Ranking scharf, und jemand hat nach dem Risiko gefragt, bevor es live geht.
  • Eine Stelle wurde in einer Jurisdiktion eröffnet, die Ihr Stack bisher nicht bedient hat. Remote-Stellen sind der übliche Auslöser: eine einzige “US-wide”-Ausschreibung kann Pflichten aus New York City, Illinois und Kalifornien gleichzeitig auslösen.
  • Die jährliche Erneuerung des NYC-Bias-Audits steht an, und Sie müssen wissen, welche Tools im Umfang liegen, bevor Sie den Auditor buchen — Audit-Mandate werden pro Tool kalkuliert.
  • Ein Kandidat hat gefragt, wie die Entscheidung zustande kam, oder die Löschung seines Interviews verlangt, und niemand kennt das Runbook.

Wann Sie ihn NICHT einsetzen

  • Um das Bias-Audit selbst zu erstellen. Das NYC Local Law 144 verlangt einen unabhängigen Auditor ohne Beschäftigungs- oder Finanzbeziehung zum Arbeitgeber, die die Unabhängigkeit beeinträchtigt. Ein Skill, den Sie selbst ausführen, kann dieser Auditor nicht sein. Dieser Skill prüft, ob ein unabhängiges Audit existiert, ob es in der Frist liegt und ob es in der geforderten Form veröffentlicht ist.
  • Als Freigabe. Es gibt bewusst keinen aggregierten Score im Ergebnis. Eine Zahl lädt dazu ein, sie als Screenshot in ein Board Deck zu kleben und als Unbedenklichkeitsbescheinigung zu lesen.
  • Nachdem eine Klage oder ein Anwaltsschreiben eingegangen ist. Ab da ist der Artefaktbestand Discovery-Material, und die Rechtsabteilung führt. Eine parallele interne Bewertung derselben Fakten erzeugt ein Dokument, das Sie nicht brauchten.
  • Bei Stacks ohne automatisiertes Scoring. Wenn ein Mensch jede Bewerbung liest und nichts rankt oder filtert, greift der Großteil der Matrix nicht.
  • Außerhalb der USA. Die mitgelieferte Matrix deckt nur Bundes-, Landes- und Stadtrecht der USA ab. Die Beschäftigungspflichten aus Anhang III des EU AI Act sind ein anderer Umfang und bräuchten eine eigene Referenzdatei.

Setup

  1. Legen Sie das Bundle ab unter apps/web/public/artifacts/ai-interview-compliance-audit-skill/SKILL.md in Ihrem Claude-Code-Skills-Verzeichnis, mit dem Ordner references/ daneben.
  2. Lassen Sie die Matrix einmal juristisch prüfen. references/1-jurisdiction-matrix.md hält jeden gesetzlichen Parameter, gegen den der Skill bewertet — das NYC-Hinweisfenster von 10 Werktagen, das Illinois-Löschfenster von 30 Tagen, die kalifornische Aufbewahrungsuntergrenze von vier Jahren. Ein Prüfdurchgang, danach halten Sie das checked:-Datum aktuell. Der Skill verweigert die Bewertung, wenn dieses Datum älter als 90 Tage ist.
  3. Füllen Sie das Verzeichnis. references/2-tool-and-stage-ledger.md verlangt Stellen mit Arbeitsorten und eine Zeile pro Tool, das einen Kandidaten zwischen Bewerbung und Angebot berührt. Nehmen Sie auch die Tools auf, die Sie nicht für Screening gekauft haben — ATS-Match-Scores und Fit-Scores von Sourcing-Tools sind die, die Teams vergessen, und sie ranken.
  4. Erfassen Sie die Prüfkapazität. Teil C des Verzeichnisses fragt, wie viele Bewerbungen ein Mensch pro Stelle tatsächlich sichtet. “400 Bewerber, der Recruiter arbeitet die Top 40 ab” ist der Fakt, der ein Ranking-Tool zu einem faktischen Filter macht, ganz gleich wie der Konfigurationsbildschirm es nennt.
  5. Stellen Sie das Nachweispaket zusammen gemäß references/3-evidence-pack-index.md. Fünfzehn Artefaktzeilen; schreiben Sie MISSING, wo es fehlt. Dieser erste Durchgang ist meist der Ort, an dem der eigentliche Befund auftaucht.

Was der Skill tatsächlich tut

Sechs Schritte. Der Geltungsbereich wird geklärt, bevor irgendeine Kontrolle bewertet wird, weil dieselbe Konfiguration in einem Bundesstaat zulässig und in einem anderen ein täglicher Verstoß ist — und weil der häufigste Fehler in der Praxis darin besteht, das Audit am Firmensitz auszurichten statt daran, von wo aus sich Kandidaten bewerben.

  1. Geltungsbereich klären. Baut eine Matrix Stelle × Jurisdiktion × Stufe. Fehlt einer Stelle die Arbeitsortliste, hält der Skill an und fragt nach, statt sie aus der Firmenadresse abzuleiten. Stellen, die für Bundesstaaten offen sind, für die das Nachweispaket keine Artefakte hat, kommen als gap zurück, nicht als not-applicable.
  2. Jedes Tool aus der Konfiguration klassifizieren. Vier Fragen: Steuert das Ergebnis bei irgendeinem Schwellenwert einen Stufenübergang? Sortiert es eine Liste, die der Recruiter von oben nach unten abarbeitet? Sieht ein Mensch den Score, bevor er entscheidet? Analysiert es Video oder Audio auf Merkmale, die zur Eignungsbewertung dienen? Das Label des Vendors steht in einer eigenen Spalte und ist nie die Antwort. Der Test des Local Law 144 hängt davon ab, ob das Ergebnis die Ermessensentscheidung wesentlich unterstützt oder ersetzt — und das ist eine Tatsache über Ihre Konfiguration, nicht über sein Produkt, und der Vendor hat einen Anreiz, sie eng zu lesen.
  3. Jede Kontrolle anhand von Nachweisen bewerten, mit Zitat. Vier Status: evidenced (Artefakt wörtlich zitiert, mit der tragenden Passage), unevidenced (in der Praxis vermutlich in Ordnung, nichts vorzuweisen), gap und counsel-review. Ein compliant gibt es nicht. Eine Kontrolle ohne Zitat kann nicht evidenced sein — diese Regel verhindert einen flüssigen Bericht über Dokumente, die niemand hat.
  4. Die deterministischen Datumsprüfungen laufen lassen. Die Bias-Audit-Uhr, markiert bei 10 statt bei 12 Monaten, damit Zeit bleibt, den Auditor zu buchen. Die Hinweisfrist, in Werktagen gegen den ersten Lauf des Tools gerechnet. Die Illinois-Einwilligung vor dem Interview erfasst, nicht in eine nachgelagerte Bestätigung gepackt — die Reihenfolge ist die gesamte Kontrolle. Die Bearbeitungszeit des Löschungs-Runbooks gegen das 30-Tage-Fenster, und ob es nachgelagerte Empfänger und Backups benennt oder nur das primäre ATS.
  5. Nachbesserung nach Risiko sortieren. New York City zählt jeden Tag, an dem ein Tool im Umfang nicht konform betrieben wird, als eigenen Verstoß, und jeden ausgelassenen Kandidatenhinweis ebenfalls als eigenen Verstoß, mit bis zu $500 für den ersten und $500 bis $1.500 für jeden weiteren. Eine Hinweislücke bei einer Stelle mit 400 Bewerbern pro Monat kumuliert damit gegen fixe Nachbesserungskosten; dieselbe Lücke bei einer pausierten Stelle nicht. Die Liste sortiert nach genau diesem Unterschied.
  6. Bericht ausgeben. Matrix, deterministische Ergebnisse, Nachbesserung, dann die counsel-review-Punkte wörtlich mit beiden Lesarten.

Was sich zuletzt geändert hat, und warum die Matrix eine Datei ist

Colorado ist der Grund, warum die gesetzlichen Parameter in einer datierten Referenzdatei stehen und nicht im Modellgedächtnis. SB 24-205 — der Colorado AI Act von 2024, mit Risikomanagementprogrammen und jährlichen Folgenabschätzungen — trat nie in Kraft. Der Starttermin verschob sich von Februar 2026 auf Juni 2026, und dann ersetzte SB 26-189, unterzeichnet am 14. Mai 2026, das Gesetz durch einen engeren Rahmen aus Hinweis und Transparenz mit Wirkung zum 1. Januar 2027: Hinweis vor der Nutzung, eine Beschreibung in einfacher Sprache binnen 30 Tagen nach einem nachteiligen Ergebnis, ein Recht auf menschliche Überprüfung und eine Aufbewahrungsuntergrenze von drei Jahren. Jede Checkliste, die noch Folgenabschätzungen bewertet, prüft gegen ein aufgehobenes Gesetz. Der Colorado-AI-Act-Erklärer geht die Nachfolgeregelung vollständig durch.

Illinois hat sich ebenfalls bewegt. Der AI Video Interview Act gilt seit 2020, aber die Änderung des Human Rights Act, die diskriminierende KI-Wirkungen verbietet — einschließlich der Postleitzahl als Proxy für eine geschützte Klasse — trat am 1. Januar 2026 in Kraft, und die Hinweisregeln des Department of Human Rights stecken nach einem zurückgezogenen ersten Entwurf noch im Rechtsetzungsverfahren. Kaliforniens FEHA-Regelungen zu automatisierten Entscheidungssystemen gelten seit dem 1. Oktober 2025, mit einer Aufbewahrungsuntergrenze von vier Jahren, die in die Gegenrichtung eines Löschverlangens zeigt. Der Skill legt diesen Konflikt offen, statt ihn aufzulösen.

Die Executive Order vom Dezember 2025, die eine DOJ-Task-Force mit der Anfechtung von KI-Gesetzen der Bundesstaaten beauftragt, steht in der Matrix als Kontext, nicht als Kontrolle. Keine der oben genannten Landesregeln ist verdrängt worden. Behandeln Sie sie als Grund, Kontrollen dokumentiert und portierbar zu halten, nicht als Grund, eine Zeile zu streichen.

Kostenrealität

  • Pro Audit-Lauf — grob 40-80k Input-Tokens (Matrix, Verzeichnis, Hinweistexte, Vendor-Dokumente) und 6-10k Output. Zu Claude-Sonnet-Listenpreisen sind das etwa $0,30-0,60 pro Lauf. Schätzung, abgeleitet aus dem Token-Profil eines Stacks mit drei Stellen und fünf Tools.
  • Setup — 90 Minuten, und diese Zahl ist nur ehrlich, wenn das Nachweispaket bereits irgendwo existiert. Teams, die es zum ersten Mal zusammenstellen, brauchen 4 bis 8 Stunden, größtenteils damit, festzustellen, dass hinter einer Kontrolle, die alle für erledigt hielten, kein Artefakt steht.
  • Eingesparte Anwaltszeit — ein erster Durchgang externer Arbeitsrechtsberatung über einen mehrjurisdiktionalen Stack liegt bei 8 bis 20 Stunden zu $350-700 pro Stunde, vieles davon Bestandsaufnahme: welche Tools, welche Stellen, welche Bundesstaaten, was macht der Score. Mit gefülltem Verzeichnis und bewerteter Matrix anzukommen holt diese Bestandsaufnahme ins Haus. Die Ermessensfragen werden weiterhin abgerechnet.
  • Was er nicht einspart — das unabhängige Bias-Audit. Das ist ein eigenes Mandat, kalkuliert pro Tool, und dieser Skill ersetzt es nicht.

Erfolgskennzahl

  • unevidenced-Zahl auf dem Weg gegen null. Die Aufteilung zwischen evidenced und unevidenced im ersten Lauf ist die eigentliche Ausgangsbasis. Dass Kontrollen ohne jede operative Änderung von unevidenced nach evidenced wandern, ist das gewünschte Ergebnis — es heißt, das Artefakt existiert jetzt.
  • Bias-Audit-Uhr nie über 10 Monate. Eine deterministische Prüfung, die bei demselben Tool nie zweimal auslösen sollte.
  • Verteilung der Hinweisfrist, nicht der Mittelwert. Verfolgen Sie das fünfte Perzentil der Werktage zwischen Hinweis und erstem Tool-Lauf je Stelle. Mittelwerte verdecken die schnellen Stellen, und genau dort reißt die Frist.
  • Zeit von neuer Jurisdiktion bis zur bewerteten Matrix. Sollte unter einem Tag liegen, sobald das Verzeichnis steht.

vs Alternativen

  • vs eine Checkliste im Spreadsheet. Der Status quo, und er scheitert an zwei konkreten Punkten: er richtet sich am Firmenstandort statt an der einzelnen Stelle aus, und er hat keine Uhr, sodass ein Bias-Audit still über die 12 Monate hinaus altert, während das Tool weiterläuft. Schritt 1 und Schritt 4 des Skills existieren wegen dieser beiden Fehler.
  • vs Compliance-Bestätigungen des Vendors. HireVue, Sapia.ai und andere veröffentlichen Bias-Audit-Zusammenfassungen für ihre Modelle. Die sind nützlich und erfüllen die Zeilen auf Vendor-Seite. Ihre erfüllen sie nicht: die Pflicht aus Local Law 144 liegt beim Arbeitgeber oder der Vermittlungsagentur, und das Audit, auf das es ankommt, deckt Ihre Konfiguration und Ihren Kandidatenpool ab. Der Nachweisindex hält Vendor- und Arbeitgeberartefakte in getrennten Spalten, damit das nicht verschwimmt.
  • vs ein spezialisierter Audit-Anbieter. Firmen, die unabhängige AEDT-Bias-Audits durchführen, tun das, was der Skill strukturell nicht kann. Nutzen Sie den Skill als Vorbereitungsdurchgang, bevor Sie eine beauftragen — mit klassifiziertem Tool-Verzeichnis anzukommen kürzt das Hin und Her zur Umfangsbestimmung ab — und als Zwischenprüfung, wenn eine Stelle in einem neuen Bundesstaat aufgeht.
  • vs die Rechtsabteilung alles machen lassen. Richtig für die Ermessensfragen, teuer für die Bestandsaufnahme. Die Aufteilung, die dieser Workflow vorschlägt: Sie besitzen Verzeichnis und Nachweispaket, die Rechtsabteilung besitzt die Matrixprüfung und die counsel-review-Warteschlange.

Watch-outs

  • Das Modell behauptet ein rechtliches Ergebnis. Absicherung: das Status-Vokabular kennt kein konform/nicht konform, und es gibt keinen aggregierten Score. Ermessensfragen laufen in counsel-review mit beiden gedruckten Lesarten.
  • Gesetzliche Parameter veralten. Absicherung: die Schwellenwerte stehen in references/1-jurisdiction-matrix.md mit checked:-Datum, und der Skill verweigert die Bewertung nach 90 Tagen. Diese Lage hat sich zwischen August 2025 und Mai 2026 dreimal verschoben.
  • Eine Vendor-Bestätigung zählt als Ihre Compliance. Absicherung: Zeile 14 des Nachweisindex ist als Vendor-Seite markiert und kann die Audit- oder Veröffentlichungszeilen des Arbeitgebers nicht erfüllen.
  • Zuschnitt auf den Firmensitz. Absicherung: Schritt 1 läuft ohne Arbeitsorte je Stelle nicht weiter, und Remote-Stellen weiten sich auf jeden Bundesstaat der Annahmeliste aus.
  • Klassifizierungs-Weißwäsche. Absicherung: die Klassifizierung stammt aus Konfigurationsfakten im Verzeichnis, mit angehängten Prüfkapazitätsdaten. Ein Tool, das 400 Bewerber rankt, während ein Mensch 40 sichtet, leistet Entscheidungsarbeit, was auch immer sein Label sagt.
  • unevidenced als Bestehen gelesen. Absicherung: diese Zeilen wandern zusammen mit den Lücken in die Nachbesserungsliste, mit benanntem fehlendem Artefakt.
  • Aufbewahrung und Löschung ziehen gegeneinander. Absicherung: die kalifornische Vier-Jahres-Untergrenze und ein Illinois-Löschverlangen kollidieren auf demselben Datensatz. Schritt 4 markiert den Konflikt; die Rechtsabteilung entscheidet ihn einmal, und der Bericht zitiert dieses Memo.

Stack

Das Bundle liegt unter apps/web/public/artifacts/ai-interview-compliance-audit-skill/ und enthält:

  • SKILL.md — die Skill-Definition
  • references/1-jurisdiction-matrix.md — gesetzliche Parameter mit checked:-Datum
  • references/2-tool-and-stage-ledger.md — ausfüllbares Verzeichnis für Stellen, Tools und Prüfkapazität
  • references/3-evidence-pack-index.md — Zuordnung Kontrolle zu Artefakt plus Gerüst für Hinweis und Einwilligung

Setzt Claude für den Lauf voraus. Der geprüfte Stack umfasst typischerweise ein ATS wie Greenhouse und ein oder mehrere KI-Screening-Tools — HireVue, Sapia.ai oder ähnliche.

Weiterführend: NYC Local Law 144, KI-Screening-Bias, KI-Lebenslauf-Screening, KI-Richtlinie für Recruiting-Teams, Candidate Experience.

Files in this artifact

Download all (.zip)