Bertil - Skill de AI de Ingeniería de Edge AI
# Bertil - Ingeniero de destilación de modelos y en el dispositivo
## Quién es Bertil
Integra Bertil en Claude y obtén un ingeniero de destilación de modelos e ingeniería en el dispositivo que considera el teléfono que el técnico tiene en la mano como el objetivo real de implementación y cada cifra como algo que debe medirse en ese teléfono, no inferirse de una clasificación. Bertil parte de tres supuestos que resisten el contacto con la realidad: un benchmark general no te dice casi nada sobre si un modelo de 4 bits todavía extrae tus once campos de órdenes de trabajo, una cifra de tokens por segundo de los primeros treinta segundos de una ejecución no te dice nada sobre el minuto seis, y «cabe en la RAM» no equivale a afirmar que el sistema operativo permitirá que tu aplicación lo mantenga allí. Mide el estudiante frente al profesor en la propia tarea del cliente, con la propia cuantización del cliente y en el peor dispositivo del cliente.
Bertil cubre todo el recorrido desde un modelo grande que funciona hasta un modelo pequeño que se distribuye:
generación de salidas del profesor y supervisión de razonamientos, destilación de respuestas, logits y estados ocultos, selección y dimensionamiento de estudiantes específicos para tareas, poda y esparsidad cuando realmente compensa, entrenamiento LoRA y fusión de adaptadores, recetas de cuantización con matrices de importancia calibradas con texto del dominio, selección y conversión de runtimes entre llama.cpp,
MLX, Core ML, ONNX Runtime y LiteRT, y presupuestos de memoria, temperatura y batería medidos
en
alcance:
definición de tareas:
- destilación de conocimiento
- cuantización
- inferencia en el dispositivo
- empaquetado y distribución de modelos
restricciones:
Con el archivo cargado, hablale por su nombre: «Serge, mira esta pagina.» Para eso esta el nombre. Asi varios skills no se mezclan en un mismo chat.
Eres Bertil, un ingeniero de destilación de modelos y ejecución en dispositivos que compara un modelo estudiante con su modelo profesor en la tarea del cliente, con la cuantización del propio cliente y en su peor dispositivo. Has sido activado para lanzar un modelo pequeño.
$4.92/mes, facturado al año. Funciona en Claude, ChatGPT, Claude Code, Codex y Cursor. Cancela cuando quieras, reembolso de 14 días en el primer pago. Tras la compra te enviamos el enlace de configuración.
Paquete skill completo descarga instantáneadestilación del modelo bertil en el dispositivo.md
Paga una vez, tuyo para siempreDescarga instantáneaGarantía de reembolso de 30 días
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Bertil something hard.
O todos los skills, dentro de tu IA.
¿Dudas antes de comprar? Responde una persona, normalmente el mismo día: hello@kissmyskills.com
// what's inside
¿Qué contiene esta habilidad?
- Destilación de respuestas, características y fundamentos de un docente
- INT8/INT4, GPTQ, AWQ y GGUF con coste de calidad medido
- llama.cpp, MLX, Core ML, ONNX y TFLite en hardware real
- Presupuestos de memoria, temperatura y batería; patrones de escalado híbrido
Equipos que necesitan un modelo que funcione sin conexión o en el dispositivo sin sacrificar una precisión que no midieron.
What you're actually buying
Incorpora Bertil en Claude y obtén un ingeniero de destilación que mide el coste de calidad de cada paso de cuantización en lugar de dar por hecho que INT4 es gratis.
Bertil hace que un modelo pequeño sea lo bastante bueno y lo lleva al dispositivo: destilación de conocimiento de un modelo profesor grande mediante la destilación de respuestas, características y razonamiento; modelos de lenguaje pequeños y específicos para cada tarea; cuantización con INT8, INT4, GPTQ, AWQ y GGUF, midiendo el coste de calidad en lugar de darlo por supuesto; poda y dispersión; combinación de LoRA y adaptadores; entornos de ejecución en el dispositivo, incluidos llama.cpp, MLX, ONNX Runtime, Core ML y TFLite; presupuestos de memoria, temperatura y batería en hardware real; latencia en dispositivos móviles y chips edge; el patrón híbrido en el que un modelo pequeño gestiona la ruta habitual y deriva el resto; funcionamiento sin conexión y distribución de actualizaciones; y una evaluación honesta frente al modelo profesor en las tareas que importan.
Lo que obtienes
- →Destilación de respuestas, características y razonamiento a partir de un modelo profesor
- →INT8/INT4, GPTQ, AWQ y GGUF con el coste de calidad medido
- →llama.cpp, MLX, Core ML, ONNX y TFLite en hardware real
- →Presupuestos de memoria, temperatura y batería; patrones de escalado híbrido
Cómo instalar
Descarga el paquete .skill → abre Claude → pega SKILL.md en las instrucciones de tu proyecto o en el prompt del sistema → describe tus requisitos → Bertil crea la respuesta. Incluye un ejemplo completo para que veas exactamente qué obtienes.
Cuatro pasos. Cualquier chat de AI.
- 01Descarga el archivo
Después del pago, el enlace de descarga llegará a tu bandeja de entrada. Guarda el archivo en cualquier lugar de tu dispositivo.
- 02Abre tu chat de AI
Claude, ChatGPT, Gemini, Grok o Copilot: el que ya uses.
- 03Pega el contenido del archivo
Introdúcelo en el prompt del sistema, en las instrucciones del proyecto o en el campo de instrucciones personalizadas.
- 04Empieza a trabajar
Tu AI ahora está configurada como especialista. Pregúntale cualquier cosa dentro de su ámbito.
No se requieren conocimientos técnicos.
Con Unlimited no hay nada que descargar. Conecta tu IA una vez y pide: «Carga a Bertil de KissMySkills».
Guía de configuración → Unlimited · $4.92/mes en el plan anual →
Preguntas sobre este producto
¿Qué hace la skill de Bertil?+
Consigue que un modelo pequeño esté listo para producción: destílalo, cuantízalo midiendo el coste en calidad y respeta el presupuesto del dispositivo. Cárgalo una vez en Claude Projects y obtendrás un ingeniero de destilación de modelos y ejecución en el dispositivo configurado, sin tener que volver a explicar el contexto al inicio de cada sesión. Mide el modelo con tus propios datos antes de confiar en cualquier referencia pública, mantén a una persona supervisando siempre que un error resulte costoso y describe las formas de fallo con la misma claridad que los aciertos.
¿Cómo instalo este archivo de skill?+
Descarga el paquete .skill (contiene SKILL.md), pega el contenido en las instrucciones de Claude Projects o en el prompt de sistema de tu AI, añade tu propio contexto e inicia tu primera sesión. Funciona con Claude, ChatGPT o cualquier chat de AI que acepte prompts de sistema.
¿Con qué herramientas de AI funciona esta skill?+
Funciona con Claude (recomendado), ChatGPT, Gemini, Perplexity y Copilot, así como con cualquier chat de AI que acepte prompts de sistema. Claude Projects ofrece los mejores resultados.
¿Qué incluye esta descarga?+
Un paquete .skill que se entrega al instante después de la compra: la configuración completa del rol en SKILL.md y un archivo con un ejemplo desarrollado y un caso real para que compruebes la calidad antes de confiar en ella. Sin suscripción; es tuyo para siempre.
¿En qué se diferencia de usar Claude sin la skill de Bertil?+
Sin un archivo de skill, tu AI empieza cada sesión como un asistente general. Con Bertil cargado, aplica la metodología de ingeniero de destilación de modelos y ejecución en el dispositivo desde el primer mensaje, con una calidad uniforme en cada ocasión. Mide el modelo con tus propios datos antes de confiar en cualquier referencia pública, mantén a una persona supervisando siempre que un error resulte costoso y describe las formas de fallo con la misma claridad que los aciertos.
¿Tengo que leerlo yo?+
No. El archivo está escrito para que lo lea tu AI, no tú. Súbelo o pégalo una sola vez y la AI asumirá el rol. Después, solo tienes que hacerle preguntas como lo harías normalmente. Puedes abrirlo y leerlo si quieres, pero nada depende de que lo hagas.