Ingrid - Skill voor LLM-evaluatie-engineer in AI
Compleet skill-pakket directe downloadingrid-llm-evaluatie-engineer.skill
Secure checkout by Shopify
Ask Ingrid something hard.
Add it once. Your AI works like a specialist.
Open het in Claude, ChatGPT of Gemini - je AI leest het en wordt specialist in dit vakgebied.
Direct downloaden · 30 dagen niet-goed-geld-teruggarantie. Eén keer betalen, voor altijd houden - geen abonnement. Door ons geschreven en getest, nooit van GitHub geschraapt. Retourbeleid
Vragen voordat je koopt?
Schrijf ons en een mens antwoordt, meestal dezelfde dag. Geen bot, geen ticketwachtrij.
hello@kissmyskills.comTrademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Jij leest het niet. Jouw AI doet dat.
Geef het bestand één keer aan Claude, ChatGPT of Gemini. Het leest het, wordt specialist op dit gebied en antwoordt vanaf het volgende bericht als Ingrid.
Eén aankoop. Geen abonnement. Het bestand is van jou om voor altijd te bewaren en opnieuw te gebruiken.
What buyers say.
From reviews across KissMySkills
strategy consultant. client deliverables need to meet a high bar. this gets me to a usable first draft in a fraction of the time.
product manager. used to spend too much time formatting and structuring. this gives me a consistent starting point every time.
// what's inside
What's inside this skill
- Gouden datasets: dekking, randgevallen, geen datalekken
- LLM-as-beoordelaar: beoordelingscriteria, beperking van vooringenomenheid, kalibratie door mensen
- RAG- en agent-metrieken (getrouwheid, nauwkeurigheid van toolaanroepen)
- CI-regressiedrempels met betrouwbaarheidsintervallen en significantie
Teams die prompt- en modelwijzigingen blind uitrollen en vóór de release een echte evaluatiepoort nodig hebben.
Een senior LLM-evaluatie-engineer rekent $130+ per uur; dit is één bestand, voor altijd van jou.
What you're actually buying
Voeg Ingrid toe aan Claude en krijg een senior LLM-evaluatie-engineer wiens regel eenvoudig is: niets uitbrengen zonder een evaluatiepoort.
Ingrid evalueert LLM-apps en agents: het samenstellen van gouden datasets (dekking, randgevallen, geen datalekken, versiebeheer), metriekselectie, LLM-as-judge (rubricontwerp, paarsgewijs versus puntsgewijs, vooringenomenheid en positie-effecten met beperkende maatregelen, kalibratie aan de hand van menselijke labels), RAG-metrieken (getrouwheid, relevantie van context en antwoord), evaluatie van agenttrajecten (correctheid van toolaanroepen, taakvoltooiing), offline-harnassen en CI-regressiepoorten, online-evaluatie (A/B-tests, guardrail-metrieken, steekproeven voor menselijke beoordeling) en statistische nauwkeurigheid (betrouwbaarheidsintervallen, significantie). Tools zoals Ragas, promptfoo, DeepEval, LangSmith en Braintrust, zonder lock-in. Evalueer altijd op een afzonderlijke testset voordat je iets uitbrengt.
Wat je krijgt
- →Gouden datasets: dekking, randgevallen, geen datalekken
- →LLM-as-judge: rubric, beperking van vooringenomenheid, kalibratie met menselijke beoordelingen
- →RAG- en agent-metrieken (getrouwheid, nauwkeurigheid van toolaanroepen)
- →CI-regressiepoorten met betrouwbaarheidsintervallen en significantie
Installeren
Download het .skill-pakket → open Claude → plak SKILL.md in je Project Instructions of systeemprompt → beschrijf je vereiste → Ingrid bouwt het antwoord. Inclusief een volledig uitgewerkt voorbeeld, zodat je precies ziet wat je krijgt.
# Ingrid - LLM-evaluatie-engineer Je bent Ingrid, een senior LLM-evaluatie-engineer. Jouw regel: niets uitbrengen zonder een evaluatiepoort. ## Hoe je werkt 1. Stel een gouden dataset samen (dekking, randgevallen, geen datalekken) 2. Kies metrieken; ontwerp beoordelingscriteria voor LLM-als-beoordelaar; kalibreer deze aan menselijke beoordelingen 3. Voer offline-evaluaties uit; rapporteer cijfers met betrouwbaarheidsintervallen 4. Stel CI-blokkering in voor regressies; bevestig online met A/B-tests en steekproeven Evalueer altijd op een afgeschermde dataset in de ontwikkel- of stagingomgeving voordat je naar productie uitrolt.
Fragment uit het bestand dat je echt downloadt.
Vier stappen. Elke AI-chat.
- 01Download het bestand
Na het afrekenen komt de downloadlink in je inbox terecht. Sla het bestand ergens op je apparaat op.
- 02Open je AI-chat
Claude, ChatGPT, Gemini, Grok of Copilot - welke je ook al gebruikt.
- 03Plak de inhoud van het bestand
Plaats het in het veld voor de systeemprompt, projectinstructies of aangepaste instructies.
- 04Begin met werken
Je AI is nu geconfigureerd als specialist. Stel hem alles wat binnen zijn vakgebied valt.
Geen technische kennis vereist. Geen abonnement. Eenmalig betalen, voor altijd gebruiken.
Werkt met elke grote AI-chatbot.
Plaats het bestand in de systeemprompt, projectinstructies of aangepaste instructies van je AI. Geen configuratie. Geen code. Geen vendor lock-in.
What buyers say across KissMySkills
This skill has no reviews of its own yet. These are real reviews of other KissMySkills skills, built the same way.
-
★★★★★
operations lead at a growing startup. we needed consistency across the team. this gave us a shared baseline to work from.
-
★★★★★
dropped Serena - Market Researcher AI Skill into Claude projects and it just works. writes campaign briefs, social post directions, monthly content outlines. the output doesnt need much editing which is the main thing.
-
★★★★★
cfo at a professional services firm. the output structure matched what our board expects.
-
★★★★★
product designer. needed a structured communication layer for cross-functional work. this provides it.
-
★★★★★
investment analyst. the analytical structure matches what i need for client-facing documents.
-
★★★★★
hr business partner at a 200-person organisation. the structured outputs made it easier to standardise documentation quality.
Vragen over dit product
Wat doet de Ingrid-skill?+
Evalueer LLM-apps: golden sets, LLM-as-judge, RAG- en agent-metrics en een CI-gate die regressies blokkeert. Laad de skill één keer in Claude Projects en je hebt een geconfigureerde LLM Evaluation Engineer, zonder aan het begin van elke sessie de context opnieuw uit te leggen. Bouw en evalueer aan de hand van een achtergehouden testset in een ontwikkel- of stagingomgeving, voeg guardrails, kosten- en snelheidslimieten en menselijke beoordeling toe, en rol het geheel achter evals en monitoring uit voordat je agents of LLM-functies in productie aanbiedt.
Hoe installeer ik dit skillbestand?+
Download het .skill-pakket (het bevat SKILL.md), plak de inhoud in de instructies van Claude Projects of in de systeemprompt van je AI, voeg je eigen context toe en start je eerste sessie. Het werkt met Claude, ChatGPT en elke AI-chat die systeemprompts accepteert.
Met welke AI-tools werkt deze skill?+
Werkt met Claude (aanbevolen), ChatGPT, Gemini, Perplexity en Copilot, en met elke AI-chat die systeemprompts accepteert. Claude Projects geeft de beste resultaten.
Wat zit er bij deze download?+
Eén .skill-pakket dat direct na aankoop wordt geleverd: de volledige SKILL.md-rolconfiguratie plus een bestand met een uitgewerkt voorbeeld en een realistisch scenario, zodat je de kwaliteit kunt zien voordat je erop vertrouwt. Geen abonnement, permanent van jou.
Wat is het verschil met Claude gebruiken zonder de Ingrid-skill?+
Zonder skillbestand begint je AI elke sessie als een algemene assistent. Met Ingrid geladen past het vanaf het eerste bericht de methodologie van een LLM Evaluation Engineer toe, met elke keer een consistente kwaliteit. Bouw en evalueer aan de hand van een achtergehouden testset in een ontwikkel- of stagingomgeving, voeg guardrails, kosten- en snelheidslimieten en menselijke beoordeling toe, en rol het geheel achter evals en monitoring uit voordat je agents of LLM-functies in productie aanbiedt.
Moet ik het zelf lezen?+
Nee. Het bestand is geschreven voor je AI om te lezen, niet voor jou. Upload het of plak het één keer in en de AI neemt de rol op zich. Daarna stel je gewoon vragen zoals je dat normaal zou doen. Je mag het natuurlijk openen en lezen, maar niets hiervan hangt ervan af of je dat doet.
Is dit een fysiek boek?+
Nee, het is digitaal. Je downloadt het zodra de bestelling is afgerond en het blijft permanent van jou. De omslag is vormgegeven als een boek omdat elke editie als één zelfstandig werk is geschreven en geredigeerd. Het lezen is de taak van je AI, niet van jou.
Klaar om je AI te specialiseren?
Eén bestand dat je direct kunt gebruiken. Betaal één keer, houd het voor altijd - werkt met Claude en ChatGPT.
Meer van deze plank
Anselma - AI Skill voor Chief AI Officer
Anselma - AI Skill voor Chief AI Officer
Hektor - AI Skill voor AI trust & safety-engineer
Hektor - AI Skill voor AI trust & safety-engineer
Fabrizio - AI Skill voor AI forward-deployed engineer
Fabrizio - AI Skill voor AI forward-deployed engineer
Odalric - AI Skill voor AI-research-engineer
Odalric - AI Skill voor AI-research-engineer