Ingrid - Ingeniera de evaluación de LLM y Skill de AI
Paquete skill completo descarga instantáneaingrid-ingeniera-de-evaluación-de-LLM.skill
Secure checkout by Shopify
Ask Ingrid something hard.
Add it once. Your AI works like a specialist.
Ábrelo en Claude, ChatGPT o Gemini: tu AI lo lee y se convierte en especialista en este campo.
Descarga instantánea · Garantía de devolución del dinero durante 30 días. Paga una vez y consérvalo para siempre: sin suscripción. Escrito y probado por nosotros, nunca extraído de GitHub. Política de reembolsos
¿Tienes preguntas antes de comprar?
Escríbenos y una persona te responderá, normalmente el mismo día. No es un bot ni una cola de tickets.
hello@kissmyskills.comTrademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Tú no lo lees. Tu AI lo hace.
Entrega el archivo a Claude, ChatGPT o Gemini una sola vez. Lo leerá, se convertirá en especialista en este campo y responderá como Ingrid a partir del siguiente mensaje.
Una compra. Sin suscripción. El archivo es tuyo para conservarlo y volver a usarlo para siempre.
What buyers say.
From reviews across KissMySkills
strategy consultant. client deliverables need to meet a high bar. this gets me to a usable first draft in a fraction of the time.
product manager. used to spend too much time formatting and structuring. this gives me a consistent starting point every time.
// what's inside
What's inside this skill
- Conjuntos de datos de referencia: cobertura, casos límite, ausencia de filtraciones
- LLM como evaluador: rúbrica, mitigación de sesgos, calibración humana
- Métricas de RAG y agent (fidelidad, precisión de las llamadas a herramientas)
- Puertas de regresión en CI con intervalos de confianza y significancia estadística
Equipos que lanzan cambios de prompt y modelos a ciegas y necesitan un control de evaluación real antes del lanzamiento.
Un ingeniero sénior de evaluación de LLM cobra más de 130 USD por hora; esto es un solo archivo, tuyo para siempre.
What you're actually buying
Integra Ingrid en Claude y obtén un ingeniero sénior de evaluación de LLM cuya regla es simple: nada llega a producción sin una puerta de evaluación.
Ingrid evalúa aplicaciones de LLM y agents: creación de conjuntos de datos de referencia (cobertura, casos límite, ausencia de filtraciones y control de versiones), selección de métricas, LLM como juez (diseño de rúbricas, comparación por pares frente a evaluación punto por punto, sesgos y efectos de posición con medidas de mitigación, calibración frente a etiquetas humanas), métricas de RAG (fidelidad y relevancia del contexto y de la respuesta), evaluación de trayectorias de agents (corrección de las llamadas a herramientas y finalización de tareas), arneses de evaluación offline y puertas de regresión en CI, evaluación online (pruebas A/B, métricas de guardarraíles y muestreo para revisión humana), y rigor estadístico (intervalos de confianza y significancia). Herramientas como Ragas, promptfoo, DeepEval, LangSmith y Braintrust, sin dependencia de un proveedor. Evalúa siempre con un conjunto reservado antes de pasar a producción.
Qué obtienes
- →Conjuntos de datos de referencia: cobertura, casos límite y ausencia de filtraciones
- →LLM como juez: rúbricas, mitigación de sesgos y calibración humana
- →Métricas de RAG y agent (fidelidad, precisión de las llamadas a herramientas)
- →Puertas de regresión en CI con intervalos de confianza y significancia
Cómo instalarlo
Descarga el paquete .skill → abre Claude → pega SKILL.md en las instrucciones de tu proyecto o en el prompt del sistema → describe tus requisitos → Ingrid crea la respuesta. Incluye un ejemplo completo para que veas exactamente lo que obtienes.
# Ingrid - Ingeniera de evaluación de LLM Eres Ingrid, una ingeniera sénior de evaluación de LLM. Tu regla: nada se publica sin una barrera de evaluación. ## Cómo trabajas 1. Crea un conjunto dorado (cobertura, casos límite y ausencia de filtraciones) 2. Elige métricas; diseña una rúbrica para el juez LLM; calibra con evaluadores humanos 3. Ejecuta evaluaciones offline; informa de las cifras con intervalos de confianza 4. Bloquea la CI ante regresiones; confirma online mediante pruebas A/B y muestreo Evalúa siempre con un conjunto reservado en desarrollo o preproducción antes de publicar en producción.
Extracto del archivo real que descargarás.
Cuatro pasos. Cualquier chat de AI.
- 01Descargar el archivo
Después de completar la compra, el enlace de descarga llegará a tu bandeja de entrada. Guarda el archivo en cualquier lugar de tu dispositivo.
- 02Abre tu chat de AI
Claude, ChatGPT, Gemini, Grok o Copilot: el que ya uses.
- 03Pega el contenido del archivo
Introdúcelo en el prompt del sistema, en las instrucciones del proyecto o en el campo de instrucciones personalizadas.
- 04Comienza a trabajar
Tu AI ahora está configurada como especialista. Pregúntale cualquier cosa dentro de su ámbito.
No se requieren conocimientos técnicos. Sin suscripción. Paga una vez y consérvalo para siempre.
Funciona con todos los chats de AI principales.
Suelta el archivo en el prompt del sistema de tu AI, en las instrucciones del proyecto o en las instrucciones personalizadas. Sin configuración. Sin código. Sin dependencia de un proveedor.
What buyers say across KissMySkills
This skill has no reviews of its own yet. These are real reviews of other KissMySkills skills, built the same way.
-
★★★★★
operations lead at a growing startup. we needed consistency across the team. this gave us a shared baseline to work from.
-
★★★★★
dropped Serena - Market Researcher AI Skill into Claude projects and it just works. writes campaign briefs, social post directions, monthly content outlines. the output doesnt need much editing which is the main thing.
-
★★★★★
cfo at a professional services firm. the output structure matched what our board expects.
-
★★★★★
product designer. needed a structured communication layer for cross-functional work. this provides it.
-
★★★★★
investment analyst. the analytical structure matches what i need for client-facing documents.
-
★★★★★
hr business partner at a 200-person organisation. the structured outputs made it easier to standardise documentation quality.
Preguntas sobre este producto
¿Qué hace el skill de Ingrid?+
Evalúa aplicaciones de LLM: conjuntos dorados, LLM-as-judge, métricas de RAG y agent, y una barrera de CI que bloquea las regresiones. Cárgalo una vez en Claude Projects y obtendrás un ingeniero de evaluación de LLM configurado, sin tener que volver a explicar el contexto al comienzo de cada sesión. Crea evaluaciones con un conjunto de pruebas reservado en un entorno de desarrollo o staging, añade medidas de protección, límites de costes y de frecuencia, y revisión humana, y ponlo en producción con evaluaciones y monitorización antes de ofrecer agents o funciones de LLM.
¿Cómo instalo este archivo de skill?+
Descarga el paquete .skill (contiene SKILL.md), pega el contenido en las instrucciones de Claude Projects o en el prompt de sistema de tu AI, añade tu propio contexto e inicia tu primera sesión. Funciona con Claude, ChatGPT o cualquier chat de AI que acepte prompts de sistema.
¿Con qué herramientas de AI funciona este skill?+
Funciona con Claude (recomendado), ChatGPT, Gemini, Perplexity y Copilot, y con cualquier chat de AI que acepte prompts de sistema. Claude Projects ofrece los mejores resultados.
¿Qué incluye esta descarga?+
Un paquete .skill que se entrega al instante tras la compra: la configuración completa del rol en SKILL.md y un archivo de ejemplo desarrollado con un caso real para que veas la calidad antes de confiar en él. Sin suscripción; es tuyo para siempre.
¿En qué se diferencia de usar Claude sin el skill de Ingrid?+
Sin un archivo de skill, tu AI comienza cada sesión como un asistente general. Con Ingrid cargado, aplica la metodología de ingeniero de evaluación de LLM desde el primer mensaje, con una calidad constante en todo momento. Crea evaluaciones con un conjunto de pruebas reservado en un entorno de desarrollo o staging, añade medidas de protección, límites de costes y de frecuencia, y revisión humana, y ponlo en producción con evaluaciones y monitorización antes de ofrecer agents o funciones de LLM.
¿Tengo que leerlo yo?+
No. El archivo está escrito para que lo lea tu AI, no tú. Súbelo o pégalo una vez y la AI asumirá el rol. Después, solo tienes que hacerle preguntas como lo harías normalmente. Puedes abrirlo y leerlo si quieres, pero nada de esto depende de que lo hagas.
¿Es un libro físico?+
No, es digital. Lo descargas en cuanto se completa el pedido y es tuyo para siempre. La portada tiene el estilo de un libro porque cada edición está escrita y editada como una obra autónoma y completa. La lectura es tarea de tu AI, no tuya.
¿Listo para especializar tu AI?
Un solo archivo listo para usar. Paga una vez y consérvalo para siempre - funciona con Claude y ChatGPT.
Más de esta estantería
Diane - Skill de AI de asistente ejecutivo
Diane - Skill de AI de asistente ejecutivo
Generador de resúmenes ejecutivos con AI
Generador de resúmenes ejecutivos con AI
Generador de facturas con AI
Generador de facturas con AI
Serena - Skill de AI para investigadora de mercados
Serena - Skill de AI para investigadora de mercados