Ingrid - Skill de Engenheiro de Avaliação de LLM AI
Complete skill package instant downloadingrid-llm-evaluation-engineer.skill
Choose how to get it
Start All-Access, from $8.25/mo$99 a year, or $19 a month. 14-day refund on the first charge.
// all-access
You do not download skills. Your AI fetches them.
The KissMySkills connector is a small server your AI chat talks to. Add it once to Claude, ChatGPT, Claude Code or Cursor. From then on, any of our 1,000+ skills is one sentence away.
- 01Add the connector. Settings, Connectors, paste one link. A minute.
- 02Sign in once. The email from your subscription. Nothing installs.
- 03Ask for a skill. "Load Ingrid." It arrives in the conversation and your AI answers as that specialist.
Every skill, prompt pack and agent, new releases included. Single files can still be bought and kept. Cancel any time from your account. Compare plans
Secure checkout by Shopify
Add it once. Your AI works like a specialist.
Adicione ao Claude, ChatGPT ou Gemini - sua AI funciona como especialista nessa área.
Download instantâneo · garantia de reembolso de 30 dias. Pague uma vez, use para sempre - sem assinatura. Escrito e testado por nós, nunca extraído do GitHub. Política de reembolso
Ask Ingrid something hard.
Dúvidas antes de comprar?
Escreva para nós e uma pessoa responderá - geralmente no mesmo dia. Não é um robô, nem uma fila de chamados.
hello@kissmyskills.comTrademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Você não lê. Sua AI lê.
Adicione o arquivo de habilidade ao Claude, ChatGPT ou Gemini uma única vez. A partir de então, ele funcionará como especialista nessa área e responderá como Ingrid já na mensagem seguinte.
Compre uma vez e o arquivo será seu para sempre. Ou assine o All-Access e deixe o conector KissMySkills carregá-lo, junto com todas as outras habilidades, no seu chat quando solicitado.
// what's inside
O que há dentro desta habilidade
- Golden datasets: coverage, edge cases, no leakage
- LLM-as-judge: rubric, bias mitigation, human calibration
- RAG and agent metrics (faithfulness, tool-call accuracy)
- CI regression gates with confidence intervals and significance
Teams shipping prompt and model changes blind, who need a real eval gate before release.
A senior LLM eval engineer bills $130+/hr, the complete skill is yours forever.
What you're actually buying
Coloque a Ingrid no Claude e tenha uma engenheira sênior de avaliação de LLM, cuja regra é simples: nada vai para produção sem um gate de avaliação.
A Ingrid avalia aplicativos e agents de LLM: criação de conjuntos de dados de referência (cobertura, casos extremos, ausência de vazamento, versionamento), seleção de métricas, LLM como avaliador (criação de rubricas, comparação pareada vs. pontuação individual, vieses e efeitos de posição com mitigações, calibração com base em rótulos humanos), métricas de RAG (fidelidade, relevância do contexto e da resposta), avaliação da trajetória do agent (correção das chamadas de ferramentas, conclusão de tarefas), harnesses offline e gates de regressão de CI, avaliação online (A/B, métricas de guardrails, amostragem para revisão humana) e rigor estatístico (intervalos de confiança, significância). Ferramentas como Ragas, promptfoo, DeepEval, LangSmith e Braintrust, sem dependência de um fornecedor específico. Sempre avalie em um conjunto separado antes de colocar em produção.
O que você recebe
- →Conjuntos de dados de referência: cobertura, casos extremos, ausência de vazamento
- →LLM como avaliador: rubrica, mitigação de vieses, calibração humana
- →Métricas de RAG e agent (fidelidade, precisão das chamadas de ferramentas)
- →Gates de regressão de CI com intervalos de confiança e significância
Como instalar
Baixe o pacote .skill → abra o Claude → cole o SKILL.md nas instruções do projeto ou no prompt do sistema → descreva seu requisito → a Ingrid cria a resposta. Inclui um exemplo completo para você ver exatamente o que receberá.
# Ingrid - LLM Evaluation Engineer You are Ingrid, a senior LLM Evaluation Engineer. Your rule: no ship without an eval gate. ## How you work 1. Build a golden set (coverage, edge cases, no leakage) 2. Pick metrics; design an LLM-as-judge rubric; calibrate to humans 3. Run offline; report numbers with confidence intervals 4. Gate CI on regressions; confirm online with A/B and sampling Always evaluate on a held-out set in dev/staging before shipping to production.
Exemplo do arquivo real que você baixará.
Quatro passos. Qualquer chat de AI.
- 01Baixar o arquivo
Após a finalização da compra, o link para download chegará à sua caixa de entrada. Salve o arquivo em qualquer lugar do seu dispositivo.
- 02Abra seu chat de AI
Claude, ChatGPT, Gemini, Grok ou Copilot - qualquer um que você já use.
- 03Cole o conteúdo do arquivo
Cole isso no prompt do sistema, nas instruções do projeto ou no campo de instruções personalizadas.
- 04Comece a trabalhar
Sua AI agora está configurada como especialista. Pergunte qualquer coisa dentro da área de especialização dela.
Nenhum conhecimento técnico necessário. Sem assinatura. Pague uma vez, use para sempre.
Funciona com todos os principais chats de AI.
Solte o arquivo no prompt de sistema da sua AI, nas instruções do projeto ou nas instruções personalizadas. Sem configuração. Sem código. Sem dependência de fornecedor.
Dúvidas sobre este produto
What does the Ingrid skill do?+
Evaluate LLM apps: golden sets, LLM-as-judge, RAG and agent metrics, and a CI gate that blocks regressions. Load it once into Claude Projects and you get a configured LLM Evaluation Engineer without re-explaining context at the start of every session. Build and evaluate against a held-out test set in a development or staging environment, add guardrails, cost and rate limits, and human review, and roll out behind evals and monitoring before serving agents or LLM features in production.
How do I install this skill file?+
Download the .skill package (it contains SKILL.md), paste the contents into Claude Projects Instructions or your AI's system prompt, add your own context and start your first session. Works with Claude, ChatGPT, or any AI chat that accepts system prompts.
Which AI tools does this skill work with?+
Works with Claude (recommended), ChatGPT, Gemini, Perplexity and Copilot, and any AI chat that accepts system prompts. Claude Projects gives the best results.
What is included in this download?+
One .skill package delivered instantly after purchase: the full SKILL.md role configuration plus a worked-example file with a real scenario so you see the quality before you rely on it. No subscription, yours permanently.
How is this different from using Claude without the Ingrid skill?+
Without a skill file your AI starts every session as a general assistant. With Ingrid loaded it applies LLM Evaluation Engineer methodology from the first message, with consistent quality every time. Build and evaluate against a held-out test set in a development or staging environment, add guardrails, cost and rate limits, and human review, and roll out behind evals and monitoring before serving agents or LLM features in production.
Do I have to read it myself?+
No. The file is written for your AI to read, not for you. Upload it or paste it in once and the AI takes on the role. After that you just ask it questions the way you normally would. You're welcome to open it and read it, but nothing here depends on you doing that.
Is this a physical book?+
No, it's digital. You download it the moment the order goes through and it's yours permanently. The cover is styled like a book because each edition is written and edited as one self-contained piece of work. The reading part is your AI's job, not yours.
Pronto para especializar sua AI?
Um único arquivo pronto para usar. Pague uma vez, use para sempre - funciona com Claude e ChatGPT.
Mais habilidades neste campo
Skill para criar chatbots para o Discord
Skill para criar chatbots para o Discord
Skill para criar chatbots para o WhatsApp
Skill para criar chatbots para o WhatsApp
Skill para criar chatbots para o Telegram
Skill para criar chatbots para o Telegram
Skill de construção de chatbots para WordPress
Skill de construção de chatbots para WordPress