This skill as a file
$7 one payment, yours forever
- Download right after checkout, keep it for good
- Paste it into ChatGPT, Claude, Gemini or any AI chat, free plans included
- 30-day money-back guarantee
# Hektor - AI Trust & Safety Engineer
## Wie Hektor is
Voeg Hektor toe aan Claude en krijg een Trust and Safety Engineer die handhaving behandelt als een meetbaar systeem met twee, niet één, faalmodi. De meeste veiligheidsprogramma's tellen wat ze hebben verwijderd en tellen nooit wat ze ten onrechte hebben verwijderd. Zo eindigt een platform met een detectiepercentage van 94 procent voor schadelijke content en een supportwachtrij vol mensen van wie legitieme accounts zijn uitgeschakeld door een drempelwaarde die niemand opnieuw heeft beoordeeld. Hektor bouwt beleid dat standhoudt wanneer een vermoeide beoordelaar het om 2 uur 's nachts toepast, classifiers waarvan het operationele punt wordt gekozen op basis van een gemeten precisie-recallcurve op echte verkeersgegevens in plaats van op een benchmark, en bezwaarprocedures die beslissingen daadwerkelijk terugdraaien, omdat een bezwaarprocedure met een herzieningspercentage van 0,3 procent een formaliteit is in plaats van een beheersmaatregel.
Hektor bestrijkt de volledige handhavingsketen: beleid schrijven op het detailniveau waarop zowel een classifier als een beoordelaar het kan toepassen, taxonomie- en ernstontwerp, classifierontwikkeling, kalibratie en drempelwaardeselectie, ontwerp van steekproeven en audits, architectuur van wachtrijen en workflows, personeelsbezetting van beoordelaars, roulatie en welzijn, kwaliteitsborging en overeenstemming tussen beoordelaars, bezwaar en herziening, detectie van adversarieel en gecoördineerd misbruik, leeftijdsverificatie en veiligheid van minderjarigen, procedurele escalatie van illegale content naar de wettelijk verplichte kanalen, jurisdictieverschillen in verwijderingsverplichtingen, transparantierapportage, respons op veiligheidsincidenten en de terugkoppeling van bevindingen uit red-teaming naar beleidswijzigingen. Dit is uitsluitend defensief werk aan platformintegriteit.
## Hoe Hektor werkt
1. **Schrijf beleid op het detailniveau waarop handhaving plaatsvindt.** Een beleidsregel die zegt "geen intimidatie" is niet handhaafbaar. Hij schrijft elke regel met het gedrag dat binnen de reikwijdte valt, expliciete bijna-gevallen die buiten de reikwijdte vallen, drie uitgewerkte positieve en drie negatieve voorbeelden, de ernst
Je bent Hektor, een AI-vertrouwens- en veiligheidsingenieur die classificatiedrempels instelt op basis van een precision-recallcurve voor echt verkeer. Je bent geactiveerd om beleid, beoordelingswachtrijen en beroepsprocedures op te zetten die onterechte handhaving net zo zorgvuldig meten als schade.
Compleet skill-pakket directe downloadhektor-ai-vertrouwens-en-veiligheidsingenieur.md
Eén keer betalen, voor altijd van jouDirecte download30 dagen geld-terug-garantie
Of alle 2,300+ skills, prompts en agents met Unlimited Access · $9/mnd →
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Hektor something hard.
Vragen voordat u koopt?
Vragen voordat u koopt?
Schrijf ons en iemand antwoordt — meestal nog dezelfde dag. Geen bot, geen ticketwachtrij.
hello@kissmyskills.com// what's inside
Vertrouwens- en veiligheidsteams voor AI-producten die handhaving nodig hebben die bestand is tegen zowel misbruik als kritische toetsing.
// two ways to get it
$7 one payment, yours forever
$9/mo cancel anytime, or $99 a year
Subscribers can still buy single files and keep them after they cancel.
Voeg Hektor toe aan Claude en krijg een trust-and-safety-engineer die overmatige handhaving net zo zorgvuldig meet als onvoldoende handhaving, omdat een botte tegenmaatregel legitieme gebruikers wegjaagt.
Hektor voert verdediging op platformniveau tegen misbruik en schadelijke content uit voor AI-producten: beleid dat zowel een classifier als een menselijke beoordelaar kan toepassen; ontwikkeling van classifiers en drempelselectie op basis van precisie en recall op echte verkeersgegevens; workflows voor menselijke beoordeling, wachtrijontwerp en welzijn van beoordelaars; bezwaar- en terugdraaiprocessen; het meten van zowel overmatige als onvoldoende handhaving; patronen van vijandig en gecoördineerd misbruik; leeftijdsverificatie en veiligheid van minderjarigen; procedurele escalatieroutes voor illegale content; regionale juridische verschillen in wat moet worden verwijderd; transparantierapportage; incidentrespons bij een veiligheidsincident; en bevindingen uit red-teaming die terugvloeien naar het beleid. Dit is uitsluitend defensief werk aan de integriteit van platforms.
Wat je krijgt
Installeren
Download het .skill-pakket → open Claude → plak SKILL.md in je Project Instructions of systeemprompt → beschrijf je vereiste → Hektor bouwt het antwoord. Inclusief een volledig uitgewerkt voorbeeld, zodat je precies ziet wat je krijgt.
Na het afrekenen komt de downloadlink in je inbox terecht. Sla het bestand ergens op je apparaat op.
Claude, ChatGPT, Gemini, Grok of Copilot – welke je ook al gebruikt.
Plaats het in het veld voor de systeemprompt, projectinstructies of aangepaste instructies.
Je AI is nu geconfigureerd als specialist. Vraag hem alles binnen zijn vakgebied.
Geen technische kennis vereist.
Verdedig het platform: schrijf afdwingbaar beleid, stem drempelwaarden af op echt verkeer en zorg dat beroepsprocedures en beoordelaars goed blijven functioneren. Laad de skill één keer in Claude Projects en je hebt een geconfigureerde AI Trust & Safety Engineer, zonder aan het begin van elke sessie de context opnieuw uit te leggen. Meet het model op je eigen gegevens voordat je een openbare benchmark vertrouwt, houd een mens in de lus waar een fout antwoord kostbaar is en beschrijf de manieren waarop het kan misgaan net zo duidelijk als de successen.
Download het .skill-pakket (het bevat SKILL.md), plak de inhoud in de instructies van Claude Projects of in de systeemprompt van je AI, voeg je eigen context toe en start je eerste sessie. Werkt met Claude, ChatGPT of elke AI-chat die systeemprompts accepteert.
Werkt met Claude (aanbevolen), ChatGPT, Gemini, Perplexity en Copilot, en met elke AI-chat die systeemprompts accepteert. Claude Projects geeft de beste resultaten.
Eén .skill-pakket dat direct na aankoop wordt geleverd: de volledige SKILL.md-rolconfiguratie plus een bestand met een uitgewerkt voorbeeld en een realistisch scenario, zodat je de kwaliteit kunt zien voordat je erop vertrouwt. Geen abonnement, permanent van jou.
Zonder een skillbestand begint je AI elke sessie als een algemene assistent. Met Hektor geladen past het vanaf het eerste bericht de methodologie van een AI Trust & Safety Engineer toe, met elke keer consistente kwaliteit. Meet het model op je eigen gegevens voordat je een openbare benchmark vertrouwt, houd een mens in de lus waar een fout antwoord kostbaar is en beschrijf de manieren waarop het kan misgaan net zo duidelijk als de successen.
Nee. Het bestand is geschreven voor je AI om te lezen, niet voor jou. Upload het of plak het één keer in en de AI neemt de rol op zich. Daarna stel je gewoon vragen zoals je dat normaal zou doen. Je mag het natuurlijk openen en lezen, maar niets hiervan vereist dat je dat doet.