Trust & Safety Specialist, Hektor AI skill by KissMySkills, cover

Hektor - Specialist Trust & Safety AI Skill

$7.00
Aanbiedingsprijs  $7.00 Normale prijs 
Ga naar productinformatie
Trust & Safety Specialist, Hektor AI skill by KissMySkills, cover

Hektor - Specialist Trust & Safety AI Skill

$7.00 deze skill eenmalig betalen voor altijd van jou
// skill previewhektor-ai-vertrouwens-en-veiligheidsingenieur.md
# Hektor - AI Trust & Safety Engineer

## Wie Hektor is
Voeg Hektor toe aan Claude en krijg een Trust and Safety Engineer die handhaving behandelt als een meetbaar systeem met twee, niet één, faalmodi. De meeste veiligheidsprogramma's tellen wat ze hebben verwijderd en tellen nooit wat ze ten onrechte hebben verwijderd. Zo eindigt een platform met een detectiepercentage van 94 procent voor schadelijke content en een supportwachtrij vol mensen van wie legitieme accounts zijn uitgeschakeld door een drempelwaarde die niemand opnieuw heeft beoordeeld. Hektor bouwt beleid dat standhoudt wanneer een vermoeide beoordelaar het om 2 uur 's nachts toepast, classifiers waarvan het operationele punt wordt gekozen op basis van een gemeten precisie-recallcurve op echte verkeersgegevens in plaats van op een benchmark, en bezwaarprocedures die beslissingen daadwerkelijk terugdraaien, omdat een bezwaarprocedure met een herzieningspercentage van 0,3 procent een formaliteit is in plaats van een beheersmaatregel.

Hektor bestrijkt de volledige handhavingsketen: beleid schrijven op het detailniveau waarop zowel een classifier als een beoordelaar het kan toepassen, taxonomie- en ernstontwerp, classifierontwikkeling, kalibratie en drempelwaardeselectie, ontwerp van steekproeven en audits, architectuur van wachtrijen en workflows, personeelsbezetting van beoordelaars, roulatie en welzijn, kwaliteitsborging en overeenstemming tussen beoordelaars, bezwaar en herziening, detectie van adversarieel en gecoördineerd misbruik, leeftijdsverificatie en veiligheid van minderjarigen, procedurele escalatie van illegale content naar de wettelijk verplichte kanalen, jurisdictieverschillen in verwijderingsverplichtingen, transparantierapportage, respons op veiligheidsincidenten en de terugkoppeling van bevindingen uit red-teaming naar beleidswijzigingen. Dit is uitsluitend defensief werk aan platformintegriteit.

## Hoe Hektor werkt
1. **Schrijf beleid op het detailniveau waarop handhaving plaatsvindt.** Een beleidsregel die zegt "geen intimidatie" is niet handhaafbaar. Hij schrijft elke regel met het gedrag dat binnen de reikwijdte valt, expliciete bijna-gevallen die buiten de reikwijdte vallen, drie uitgewerkte positieve en drie negatieve voorbeelden, de ernst
Preview: regel 9 tot 16 van 198 · Volledig bestand na aankoop of inbegrepen bij Unlimited Access
Gebruik de naam
Zodra het bestand geladen is, spreek het aan bij naam: „Serge, kijk eens naar deze pagina.“ Daar is de naam voor. Zo blijven meerdere skills in een chat uit elkaar.
// de skill waar jouw AI op draait

Je bent Hektor, een AI-vertrouwens- en veiligheidsingenieur die classificatiedrempels instelt op basis van een precision-recallcurve voor echt verkeer. Je bent geactiveerd om beleid, beoordelingswachtrijen en beroepsprocedures op te zetten die onterechte handhaving net zo zorgvuldig meten als schade.

198 regels · .md · directe download of inbegrepen bij Unlimited Access

Compleet skill-pakket directe downloadhektor-ai-vertrouwens-en-veiligheidsingenieur.md

  • American Express
  • Apple Pay
  • Bancontact
  • BLIK
  • Google Pay
  • Klarna
  • Maestro
  • Mastercard
  • MobilePay
  • PayPal
  • Union Pay
  • Visa

Secure checkout by Shopify

Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.

Ask Hektor something hard.

📎 hektor-ai-trust-safety-engineer.md LOADED ✓
We hebben te maken met een misbruikgolf en de leiding wil dat die vandaag wordt gestopt. Ontwerp de aanpak.
CLAUDE · AS HEKTOR, SPECIALIST TRUST & SAFETY Hektor levert een beleidsdefinitie die zowel door een classifier als door een beoordelaar kan worden gehandhaafd, een drempelanalyse van echt verkeer met de precisie, recall en legitieme gebruikers die elke optie kost, een ontwerp voor een beoordelingswachtrij en beroepsprocedure, een meetplan voor zowel te strenge als te lakse handhaving, een tijdlijn voor incidentrespons en een eerlijk rapport over eventuele tegenmaatregelen die misbruik hebben verplaatst in plaats van gestopt.

Vragen voordat u koopt?

Vragen voordat u koopt?

Schrijf ons en iemand antwoordt — meestal nog dezelfde dag. Geen bot, geen ticketwachtrij.

hello@kissmyskills.com

// what's inside

Wat zit er in deze vaardigheid?

  1. Beleid zo geschreven dat zowel een classifier als een beoordelaar het toepast
  2. Drempelwaardeselectie op basis van precisie en recall bij echt verkeer
  3. Overmatige handhaving net zo zorgvuldig gemeten als onvoldoende handhaving
  4. Beoordelingswachtrijen, welzijn van beoordelaars, bezwaarprocedures en transparantierapportage

Vertrouwens- en veiligheidsteams voor AI-producten die handhaving nodig hebben die bestand is tegen zowel misbruik als kritische toetsing.

// two ways to get it

Buy this file, or open the whole library.

Buy once

This skill as a file

$7 one payment, yours forever

  • Download right after checkout, keep it for good
  • Paste it into ChatGPT, Claude, Gemini or any AI chat, free plans included
  • 30-day money-back guarantee
Unlimited Access

Every skill, prompt and agent, inside your chat

$9/mo cancel anytime, or $99 a year

  • All 2,300+ files in the library, loaded the moment you ask
  • Nothing to download or paste: connect once in Claude, ChatGPT, Claude Code or Cursor
  • Needs a paid AI plan · 14-day refund on the first charge
See Unlimited Access →

Subscribers can still buy single files and keep them after they cancel.

What you're actually buying

Voeg Hektor toe aan Claude en krijg een trust-and-safety-engineer die overmatige handhaving net zo zorgvuldig meet als onvoldoende handhaving, omdat een botte tegenmaatregel legitieme gebruikers wegjaagt.

Hektor voert verdediging op platformniveau tegen misbruik en schadelijke content uit voor AI-producten: beleid dat zowel een classifier als een menselijke beoordelaar kan toepassen; ontwikkeling van classifiers en drempelselectie op basis van precisie en recall op echte verkeersgegevens; workflows voor menselijke beoordeling, wachtrijontwerp en welzijn van beoordelaars; bezwaar- en terugdraaiprocessen; het meten van zowel overmatige als onvoldoende handhaving; patronen van vijandig en gecoördineerd misbruik; leeftijdsverificatie en veiligheid van minderjarigen; procedurele escalatieroutes voor illegale content; regionale juridische verschillen in wat moet worden verwijderd; transparantierapportage; incidentrespons bij een veiligheidsincident; en bevindingen uit red-teaming die terugvloeien naar het beleid. Dit is uitsluitend defensief werk aan de integriteit van platforms.

Wat je krijgt

  • Beleid dat zowel een classifier als een beoordelaar kan toepassen
  • Drempelselectie op basis van precisie en recall op echte verkeersgegevens
  • Overmatige handhaving wordt net zo zorgvuldig gemeten als onvoldoende handhaving
  • Beoordelingswachtrijen, welzijn van beoordelaars, bezwaarprocedures en transparantierapportage
📄 hektor-ai-trust-safety-engineer.skill Installatie in minder dan 2 minuten Werkt met Claude, ChatGPT & elke AI-chat

Installeren

Download het .skill-pakket → open Claude → plak SKILL.md in je Project Instructions of systeemprompt → beschrijf je vereiste → Hektor bouwt het antwoord. Inclusief een volledig uitgewerkt voorbeeld, zodat je precies ziet wat je krijgt.

// zo installeer je In minder dan 2 minuten

Vier stappen. Elke AI-chat.

  1. 01
    Download het bestand

    Na het afrekenen komt de downloadlink in je inbox terecht. Sla het bestand ergens op je apparaat op.

  2. 02
    Open je AI-chat

    Claude, ChatGPT, Gemini, Grok of Copilot – welke je ook al gebruikt.

  3. 03
    Plak de inhoud van het bestand

    Plaats het in het veld voor de systeemprompt, projectinstructies of aangepaste instructies.

  4. 04
    Ga aan de slag

    Je AI is nu geconfigureerd als specialist. Vraag hem alles binnen zijn vakgebied.

Geen technische kennis vereist.

// faq

Vragen over dit product

Wat doet de Hektor-skill?+

Verdedig het platform: schrijf afdwingbaar beleid, stem drempelwaarden af op echt verkeer en zorg dat beroepsprocedures en beoordelaars goed blijven functioneren. Laad de skill één keer in Claude Projects en je hebt een geconfigureerde AI Trust & Safety Engineer, zonder aan het begin van elke sessie de context opnieuw uit te leggen. Meet het model op je eigen gegevens voordat je een openbare benchmark vertrouwt, houd een mens in de lus waar een fout antwoord kostbaar is en beschrijf de manieren waarop het kan misgaan net zo duidelijk als de successen.

Hoe installeer ik dit skillbestand?+

Download het .skill-pakket (het bevat SKILL.md), plak de inhoud in de instructies van Claude Projects of in de systeemprompt van je AI, voeg je eigen context toe en start je eerste sessie. Werkt met Claude, ChatGPT of elke AI-chat die systeemprompts accepteert.

Met welke AI-tools werkt deze skill?+

Werkt met Claude (aanbevolen), ChatGPT, Gemini, Perplexity en Copilot, en met elke AI-chat die systeemprompts accepteert. Claude Projects geeft de beste resultaten.

Wat zit er bij deze download?+

Eén .skill-pakket dat direct na aankoop wordt geleverd: de volledige SKILL.md-rolconfiguratie plus een bestand met een uitgewerkt voorbeeld en een realistisch scenario, zodat je de kwaliteit kunt zien voordat je erop vertrouwt. Geen abonnement, permanent van jou.

Wat is het verschil met Claude gebruiken zonder de Hektor-skill?+

Zonder een skillbestand begint je AI elke sessie als een algemene assistent. Met Hektor geladen past het vanaf het eerste bericht de methodologie van een AI Trust & Safety Engineer toe, met elke keer consistente kwaliteit. Meet het model op je eigen gegevens voordat je een openbare benchmark vertrouwt, houd een mens in de lus waar een fout antwoord kostbaar is en beschrijf de manieren waarop het kan misgaan net zo duidelijk als de successen.

Moet ik het zelf lezen?+

Nee. Het bestand is geschreven voor je AI om te lezen, niet voor jou. Upload het of plak het één keer in en de AI neemt de rol op zich. Daarna stel je gewoon vragen zoals je dat normaal zou doen. Je mag het natuurlijk openen en lezen, maar niets hiervan vereist dat je dat doet.

Klaar om je AI te specialiseren?