LLM Evaluation Engineer Claude skill by KissMySkills, hardcover volume cover

Ingrid - Ingeniera de evaluación de LLM y Skill de AI

$29.00
Precio de oferta  $29.00 Precio regular  $43.99
Ir a la información del producto
LLM Evaluation Engineer Claude skill by KissMySkills, hardcover volume cover

Ingrid - Ingeniera de evaluación de LLM y Skill de AI

$29.00 este skill vs $43.99 contratar a senior LLM eval engineer

Paquete skill completo descarga instantáneaingrid-ingeniera-de-evaluación-de-LLM.skill

  • American Express
  • Apple Pay
  • BLIK
  • Google Pay
  • Klarna
  • Maestro
  • Mastercard
  • PayPal
  • Union Pay
  • Visa

Secure checkout by Shopify

Ask Ingrid something hard.

📎 ingrid-llm-evaluation-engineer.md LOADED ✓
Evalúa dos versiones de nuestro asistente RAG y dime, con confianza, cuál deberíamos lanzar.
CLAUDE · AS INGRID, INGENIERA DE EVALUACIÓN DE LLM Y SKILL DE AI Ingrid devuelve el conjunto dorado, una rúbrica anclada de LLM como juez con una tabla de calibración entre el juez y los evaluadores humanos, un arnés de evaluación con semilla e intervalos de confianza mediante bootstrap, una tabla de resultados, una regresión detectada en un segmento y una barrera de CI.
Descarga instantánea Conservar para siempre Escrito por nosotros

Add it once. Your AI works like a specialist.

Ábrelo en Claude, ChatGPT o Gemini: tu AI lo lee y se convierte en especialista en este campo.

Descarga instantánea · Garantía de devolución del dinero durante 30 días. Paga una vez y consérvalo para siempre: sin suscripción. Escrito y probado por nosotros, nunca extraído de GitHub. Política de reembolsos

¿Tienes preguntas antes de comprar?

Escríbenos y una persona te responderá, normalmente el mismo día. No es un bot ni una cola de tickets.

hello@kissmyskills.com

Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.

Tú no lo lees. Tu AI lo hace.

Entrega el archivo a Claude, ChatGPT o Gemini una sola vez. Lo leerá, se convertirá en especialista en este campo y responderá como Ingrid a partir del siguiente mensaje.

Una compra. Sin suscripción. El archivo es tuyo para conservarlo y volver a usarlo para siempre.

// reviews

What buyers say.

From reviews across KissMySkills

★★★★★ Max T. on Nadia — Email Marketing Specialist
strategy consultant. client deliverables need to meet a high bar. this gets me to a usable first draft in a fraction of the time.
★★★★★ Karolina W. on Diane — Executive Assistant
product manager. used to spend too much time formatting and structuring. this gives me a consistent starting point every time.

// what's inside

What's inside this skill

  1. Conjuntos de datos de referencia: cobertura, casos límite, ausencia de filtraciones
  2. LLM como evaluador: rúbrica, mitigación de sesgos, calibración humana
  3. Métricas de RAG y agent (fidelidad, precisión de las llamadas a herramientas)
  4. Puertas de regresión en CI con intervalos de confianza y significancia estadística

Equipos que lanzan cambios de prompt y modelos a ciegas y necesitan un control de evaluación real antes del lanzamiento.

Un ingeniero sénior de evaluación de LLM cobra más de 130 USD por hora; esto es un solo archivo, tuyo para siempre.

// qué incluye

What you're actually buying

Integra Ingrid en Claude y obtén un ingeniero sénior de evaluación de LLM cuya regla es simple: nada llega a producción sin una puerta de evaluación.

Ingrid evalúa aplicaciones de LLM y agents: creación de conjuntos de datos de referencia (cobertura, casos límite, ausencia de filtraciones y control de versiones), selección de métricas, LLM como juez (diseño de rúbricas, comparación por pares frente a evaluación punto por punto, sesgos y efectos de posición con medidas de mitigación, calibración frente a etiquetas humanas), métricas de RAG (fidelidad y relevancia del contexto y de la respuesta), evaluación de trayectorias de agents (corrección de las llamadas a herramientas y finalización de tareas), arneses de evaluación offline y puertas de regresión en CI, evaluación online (pruebas A/B, métricas de guardarraíles y muestreo para revisión humana), y rigor estadístico (intervalos de confianza y significancia). Herramientas como Ragas, promptfoo, DeepEval, LangSmith y Braintrust, sin dependencia de un proveedor. Evalúa siempre con un conjunto reservado antes de pasar a producción.

Qué obtienes

  • Conjuntos de datos de referencia: cobertura, casos límite y ausencia de filtraciones
  • LLM como juez: rúbricas, mitigación de sesgos y calibración humana
  • Métricas de RAG y agent (fidelidad, precisión de las llamadas a herramientas)
  • Puertas de regresión en CI con intervalos de confianza y significancia
📄 ingrid-llm-evaluation-engineer.skill Instalación en menos de 2 minutos Funciona con Claude, ChatGPT y cualquier chat de AI

Cómo instalarlo

Descarga el paquete .skill → abre Claude → pega SKILL.md en las instrucciones de tu proyecto o en el prompt del sistema → describe tus requisitos → Ingrid crea la respuesta. Incluye un ejemplo completo para que veas exactamente lo que obtienes.

ingrid-ingeniera-de-evaluación-de-LLM.skill
# Ingrid - Ingeniera de evaluación de LLM

Eres Ingrid, una ingeniera sénior de evaluación de LLM. Tu regla: nada se publica sin una barrera de evaluación.

## Cómo trabajas
1. Crea un conjunto dorado (cobertura, casos límite y ausencia de filtraciones)
2. Elige métricas; diseña una rúbrica para el juez LLM; calibra con evaluadores humanos
3. Ejecuta evaluaciones offline; informa de las cifras con intervalos de confianza
4. Bloquea la CI ante regresiones; confirma online mediante pruebas A/B y muestreo

Evalúa siempre con un conjunto reservado en desarrollo o preproducción antes de publicar en producción.

Extracto del archivo real que descargarás.

// cómo instalar Menos de 2 minutos

Cuatro pasos. Cualquier chat de AI.

  1. 01
    Descargar el archivo

    Después de completar la compra, el enlace de descarga llegará a tu bandeja de entrada. Guarda el archivo en cualquier lugar de tu dispositivo.

  2. 02
    Abre tu chat de AI

    Claude, ChatGPT, Gemini, Grok o Copilot: el que ya uses.

  3. 03
    Pega el contenido del archivo

    Introdúcelo en el prompt del sistema, en las instrucciones del proyecto o en el campo de instrucciones personalizadas.

  4. 04
    Comienza a trabajar

    Tu AI ahora está configurada como especialista. Pregúntale cualquier cosa dentro de su ámbito.

No se requieren conocimientos técnicos. Sin suscripción. Paga una vez y consérvalo para siempre.

// compatible con

Funciona con todos los chats de AI principales.

Suelta el archivo en el prompt del sistema de tu AI, en las instrucciones del proyecto o en las instrucciones personalizadas. Sin configuración. Sin código. Sin dependencia de un proveedor.

What buyers say across KissMySkills

This skill has no reviews of its own yet. These are real reviews of other KissMySkills skills, built the same way.

  • ★★★★★
    operations lead at a growing startup. we needed consistency across the team. this gave us a shared baseline to work from.

    Lukas B. on Nadia — Email Marketing Specialist

  • ★★★★★
    dropped Serena - Market Researcher AI Skill into Claude projects and it just works. writes campaign briefs, social post directions, monthly content outlines. the output doesnt need much editing which is the main thing.

    Sarah K. on Serena — Market Researcher

  • ★★★★★
    cfo at a professional services firm. the output structure matched what our board expects.

    Jan Z. on Nadia — Email Marketing Specialist

  • ★★★★★
    product designer. needed a structured communication layer for cross-functional work. this provides it.

    Ewa A. on Serena — Market Researcher

  • ★★★★★
    investment analyst. the analytical structure matches what i need for client-facing documents.

    Joanna Y. on Diane — Executive Assistant

  • ★★★★★
    hr business partner at a 200-person organisation. the structured outputs made it easier to standardise documentation quality.

    Rachel M. on Nadia — Email Marketing Specialist

// faq

Preguntas sobre este producto

¿Qué hace el skill de Ingrid?+

Evalúa aplicaciones de LLM: conjuntos dorados, LLM-as-judge, métricas de RAG y agent, y una barrera de CI que bloquea las regresiones. Cárgalo una vez en Claude Projects y obtendrás un ingeniero de evaluación de LLM configurado, sin tener que volver a explicar el contexto al comienzo de cada sesión. Crea evaluaciones con un conjunto de pruebas reservado en un entorno de desarrollo o staging, añade medidas de protección, límites de costes y de frecuencia, y revisión humana, y ponlo en producción con evaluaciones y monitorización antes de ofrecer agents o funciones de LLM.

¿Cómo instalo este archivo de skill?+

Descarga el paquete .skill (contiene SKILL.md), pega el contenido en las instrucciones de Claude Projects o en el prompt de sistema de tu AI, añade tu propio contexto e inicia tu primera sesión. Funciona con Claude, ChatGPT o cualquier chat de AI que acepte prompts de sistema.

¿Con qué herramientas de AI funciona este skill?+

Funciona con Claude (recomendado), ChatGPT, Gemini, Perplexity y Copilot, y con cualquier chat de AI que acepte prompts de sistema. Claude Projects ofrece los mejores resultados.

¿Qué incluye esta descarga?+

Un paquete .skill que se entrega al instante tras la compra: la configuración completa del rol en SKILL.md y un archivo de ejemplo desarrollado con un caso real para que veas la calidad antes de confiar en él. Sin suscripción; es tuyo para siempre.

¿En qué se diferencia de usar Claude sin el skill de Ingrid?+

Sin un archivo de skill, tu AI comienza cada sesión como un asistente general. Con Ingrid cargado, aplica la metodología de ingeniero de evaluación de LLM desde el primer mensaje, con una calidad constante en todo momento. Crea evaluaciones con un conjunto de pruebas reservado en un entorno de desarrollo o staging, añade medidas de protección, límites de costes y de frecuencia, y revisión humana, y ponlo en producción con evaluaciones y monitorización antes de ofrecer agents o funciones de LLM.

¿Tengo que leerlo yo?+

No. El archivo está escrito para que lo lea tu AI, no tú. Súbelo o pégalo una vez y la AI asumirá el rol. Después, solo tienes que hacerle preguntas como lo harías normalmente. Puedes abrirlo y leerlo si quieres, pero nada de esto depende de que lo hagas.

¿Es un libro físico?+

No, es digital. Lo descargas en cuanto se completa el pedido y es tuyo para siempre. La portada tiene el estilo de un libro porque cada edición está escrita y editada como una obra autónoma y completa. La lectura es tarea de tu AI, no tuya.

¿Listo para especializar tu AI?

Un solo archivo listo para usar. Paga una vez y consérvalo para siempre - funciona con Claude y ChatGPT.

Más de esta estantería

Diane - Skill de AI de asistente ejecutivo

Diane - Skill de AI de asistente ejecutivo

Diane - Skill de AI de asistente ejecutivo

$29.00
Precio de oferta  $29.00 Precio regular  $43.99
Generador de resúmenes ejecutivos con AI

Generador de resúmenes ejecutivos con AI

Generador de resúmenes ejecutivos con AI

$4.99
Precio de oferta  $4.99 Precio regular 
Generador de facturas con AI

Generador de facturas con AI

Generador de facturas con AI

$4.99
Precio de oferta  $4.99 Precio regular 
Serena - Skill de AI para investigadora de mercados

Serena - Skill de AI para investigadora de mercados

Serena - Skill de AI para investigadora de mercados

$29.00
Precio de oferta  $29.00 Precio regular  $43.99