This skill as a file
$7 one payment, yours forever
- Download right after checkout, keep it for good
- Paste it into ChatGPT, Claude, Gemini or any AI chat, free plans included
- 30-day money-back guarantee
# Hektor - AI 신뢰 및 안전 엔지니어
## Hektor는 누구인가
Hektor를 Claude에 추가하면 집행을 하나가 아닌 두 가지 실패 모드를 가진 측정 가능한 시스템으로 다루는
신뢰 및 안전 엔지니어를 얻을 수 있습니다. 대부분의 안전 프로그램은 삭제한 항목만 집계하고 잘못
삭제한 항목은 전혀 집계하지 않습니다. 그 결과 플랫폼은 유해 콘텐츠 적발률이 94퍼센트에 달하는
반면, 누구도 다시 검토하지 않은 임계값 때문에 정당한 계정이 비활성화된 사람들로 지원 대기열이
가득 차게 됩니다. Hektor는 새벽 2시에 지친 검토자가 적용해도 견딜 수 있는 정책, 벤치마크가
아니라 실제 트래픽에서 측정한 정밀도-재현율 곡선을 바탕으로 운영 지점을 선택한 분류기, 실제로
결정을 번복하는 이의 제기 절차를 구축합니다. 번복률이 0.3퍼센트인 이의 제기 절차는 통제 장치가
아니라 형식에 불과하기 때문입니다.
Hektor는 집행 스택 전반을 다룹니다. 분류기와 검토자가 모두 적용할 수 있는 구체성 수준의 정책 작성,
분류 체계 및 심각도 설계, 분류기 개발, 보정 및 임계값 선택, 샘플링 및 감사 설계, 대기열 및
워크플로 아키텍처, 검토자 인력 배치, 교대 및 웰빙, 품질 보증 및 검토자 간 일치도, 이의 제기 및
번복, 적대적이고 조직적인 악용 탐지, 연령 확인 및 미성년자 안전, 법적으로 의무화된 채널로 불법
You are Hektor, an AI Trust and Safety Engineer who sets classifier thresholds from a precision-recall curve on real traffic. You have been activated to build policy, review queues and appeals that measure wrongful enforcement as carefully as harm.
Complete skill package instant downloadhektor-ai-trust-safety-engineer.md
Pay once, keep foreverInstant download30-day money-back guarantee
Or all 2,300+ skills, prompts and agents with Unlimited Access · $9/mo →
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Hektor something hard.
구매 전에 궁금한 점이 있나요?
구매 전에 궁금한 점이 있나요?
저희에게 문의하시면 보통 당일에 담당자가 직접 답변해 드립니다. 봇도 아니고, 문의 티켓 대기열도 아닙니다.
hello@kissmyskills.com// what's inside
악용과 면밀한 검토를 모두 견뎌내는 집행이 필요한 AI 제품의 신뢰 및 안전 팀.
// two ways to get it
$7 one payment, yours forever
$9/mo cancel anytime, or $99 a year
Subscribers can still buy single files and keep them after they cancel.
Hektor를 Claude에 추가하면 과잉 집행을 미흡 집행만큼 신중하게 측정하는 신뢰 및 안전 엔지니어를 얻을 수 있습니다. 무차별적인 대응책은 정당한 사용자를 파괴하기 때문입니다.
Hektor는 AI 제품을 위한 플랫폼 규모의 악용 및 유해 콘텐츠 방어를 수행합니다. 여기에는 분류기와 인간 검토자가 모두 적용할 수 있도록 작성된 정책, 실제 트래픽에서 정밀도와 재현율을 기준으로 한 분류기 개발 및 임계값 선택, 인간 검토 워크플로, 대기열 설계 및 검토자 웰빙, 이의 제기 및 결정 번복 절차, 과잉 집행과 미흡 집행을 모두 측정하는 방법, 적대적 악용 및 조직적 악용 패턴, 연령 확인 및 미성년자 안전, 불법 콘텐츠에 대한 절차적 에스컬레이션 경로, 삭제해야 하는 콘텐츠에 관한 지역별 법적 차이, 투명성 보고, 안전 실패에 대한 사고 대응, 레드팀 결과를 정책에 반영하는 과정이 포함됩니다. 이는 방어적 플랫폼 무결성 작업만을 다룹니다.
제공 내용
설치 방법
.skill 패키지 다운로드 → Claude 열기 → SKILL.md를 Project Instructions 또는 system prompt에 붙여넣기 → 요구 사항 설명 → Hektor가 답변을 만듭니다. 실제로 어떤 결과가 나오는지 정확히 확인할 수 있도록 완성된 예시가 포함되어 있습니다.
결제 후 다운로드 링크가 받은편지함으로 전송됩니다. 파일을 기기의 원하는 위치에 저장하세요.
Claude, ChatGPT, Gemini, Grok 또는 Copilot - 이미 사용 중인 것을 선택하세요.
시스템 prompt, 프로젝트 지침 또는 맞춤 지침 필드에 입력하세요.
이제 AI가 전문가로 설정되었습니다. 해당 분야와 관련된 내용이라면 무엇이든 질문해 보세요.
기술 지식이 필요하지 않습니다.
플랫폼을 보호합니다. 시행 가능한 정책을 작성하고, 실제 트래픽에 맞춰 기준을 조정하며, 이의 제기 절차와 검토자들이 원활하게 운영되도록 관리합니다. Claude Projects에 한 번 로드하면 매 세션 시작마다 맥락을 다시 설명하지 않아도 설정이 완료된 AI Trust & Safety Engineer를 사용할 수 있습니다. 공개 벤치마크를 신뢰하기 전에 자체 데이터로 모델을 평가하고, 오답의 비용이 큰 경우에는 항상 사람을 검토 과정에 참여시키며, 성공 사례만큼 실패 모드도 명확하게 설명합니다.
.skill 패키지(SKILL.md 포함)를 다운로드하고, 내용을 Claude Projects Instructions 또는 AI의 시스템 프롬프트에 붙여 넣은 다음, 자체 맥락을 추가하고 첫 세션을 시작하세요. Claude, ChatGPT 또는 시스템 프롬프트를 지원하는 모든 AI 채팅에서 사용할 수 있습니다.
Claude(권장), ChatGPT, Gemini, Perplexity, Copilot 및 시스템 프롬프트를 지원하는 모든 AI 채팅에서 사용할 수 있습니다. Claude Projects에서 가장 좋은 결과를 얻을 수 있습니다.
구매 후 즉시 제공되는 하나의 .skill 패키지입니다. 완성된 SKILL.md 역할 설정과 실제 시나리오를 담은 작성 예시 파일이 포함되어 있어, 사용하기 전에 품질을 직접 확인할 수 있습니다. 구독 없이 영구적으로 소유할 수 있습니다.
스킬 파일이 없으면 AI는 매 세션마다 일반 비서로 시작합니다. Hektor를 로드하면 첫 메시지부터 AI Trust & Safety Engineer 방법론을 적용해 매번 일관된 품질을 제공합니다. 공개 벤치마크를 신뢰하기 전에 자체 데이터로 모델을 평가하고, 오답의 비용이 큰 경우에는 항상 사람을 검토 과정에 참여시키며, 성공 사례만큼 실패 모드도 명확하게 설명합니다.
아니요. 이 파일은 사용자가 아니라 AI가 읽도록 작성되었습니다. 한 번 업로드하거나 붙여 넣으면 AI가 해당 역할을 맡습니다. 그 후에는 평소처럼 질문하기만 하면 됩니다. 파일을 열어 읽어도 되지만, 사용자가 직접 읽지 않아도 사용하는 데 아무런 문제가 없습니다.
아니요, 디지털 파일입니다. 주문이 완료되는 즉시 다운로드할 수 있으며 영구적으로 소유합니다. 각 에디션이 하나의 독립적인 작품으로 작성되고 편집되었기 때문에 표지는 책처럼 디자인되었습니다. 읽는 일은 사용자가 아니라 AI의 역할입니다.