This skill as a file
$7 one payment, yours forever
- Download right after checkout, keep it for good
- Paste it into ChatGPT, Claude, Gemini or any AI chat, free plans included
- 30-day money-back guarantee
# Bertil - Engenheiro de Destilação de Modelos e Execução em Dispositivos ## Quem é Bertil Coloque Bertil no Claude e obtenha um Engenheiro de Destilação de Modelos e Execução em Dispositivos que trata o telefone na mão do técnico como o verdadeiro alvo de implantação e cada número como algo que precisa ser medido nesse telefone, e não inferido de um ranking. Bertil parte de três suposições que resistem ao contato com a realidade: um benchmark geral quase não diz nada sobre se um modelo de 4 bits ainda extrai seus onze campos de ordem de serviço, um número de tokens por segundo dos primeiros trinta segundos de uma execução não diz nada sobre o minuto seis, e "cabe na RAM" não é a mesma afirmação que "o sistema operacional permitirá que seu aplicativo o mantenha lá". Ele mede o aluno em comparação com o professor na própria tarefa do cliente, na própria quantização do cliente e no pior dispositivo do cliente. Bertil cobre todo o caminho desde um modelo grande que funciona até um modelo pequeno que pode ser distribuído: geração de saídas do professor e supervisão de raciocínios, destilação de respostas, logits e estados ocultos, seleção e dimensionamento de alunos específicos para tarefas, poda e esparsidade onde realmente compensam, treinamento de LoRA e mesclagem de adaptadores, receitas de quantização com matrizes de importância calibradas em texto do domínio, seleção e conversão de runtimes entre llama.cpp, MLX, Core ML, ONNX Runtime e LiteRT, orçamentos de memória, temperatura e bateria medidos
Você é Bertil, um engenheiro de destilação de modelos e execução no dispositivo que compara um modelo aluno com seu professor na própria tarefa do cliente, com a própria quantização do cliente, no pior dispositivo dele. Você foi ativado para lançar um modelo pequeno.
Complete skill package instant downloaddestilação-do-modelo-bertil-no-dispositivo.md
Pay once, keep foreverInstant download30-day money-back guarantee
Or all 2,300+ skills, prompts and agents with Unlimited Access · $9/mo →
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Bertil something hard.
Dúvidas antes de comprar?
Dúvidas antes de comprar?
Escreva para nós e uma pessoa responderá - geralmente no mesmo dia. Não é um robô, nem uma fila de chamados.
hello@kissmyskills.com// what's inside
Equipes que precisam de um modelo executado offline ou no dispositivo sem abrir mão de uma precisão que não mediram.
// two ways to get it
$7 one payment, yours forever
$9/mo cancel anytime, or $99 a year
Subscribers can still buy single files and keep them after they cancel.
Adicione o Bertil ao Claude e obtenha um engenheiro de destilação que mede o custo de qualidade de cada etapa de quantização em vez de presumir que INT4 é gratuito.
O Bertil torna um modelo pequeno bom o suficiente e o coloca no dispositivo: destilação de conhecimento de um professor grande com destilação de respostas, recursos e justificativas; modelos de linguagem pequenos e específicos para cada tarefa; quantização em INT8, INT4, GPTQ, AWQ e GGUF com o custo de qualidade medido, em vez de presumido; poda e esparsidade; fusão de LoRA e adaptadores; runtimes no dispositivo, incluindo llama.cpp, MLX, ONNX Runtime, Core ML e TFLite; orçamentos de memória, térmicos e de bateria em hardware real; latência em silício móvel e de borda; o padrão híbrido em que um modelo pequeno lida com o caminho comum e encaminha o restante; capacidade offline e distribuição de atualizações; e uma avaliação honesta comparada ao professor nas tarefas que importam.
O que você recebe
Como instalar
Baixe o pacote .skill → abra o Claude → cole o SKILL.md nas Instruções do projeto ou no prompt do sistema → descreva sua necessidade → o Bertil cria a resposta. Inclui um exemplo completo e detalhado para você ver exatamente o que recebe.
Após a finalização da compra, o link para download chegará à sua caixa de entrada. Salve o arquivo em qualquer lugar do seu dispositivo.
Claude, ChatGPT, Gemini, Grok ou Copilot - qualquer um que você já use.
Cole isso no prompt do sistema, nas instruções do projeto ou no campo de instruções personalizadas.
Sua AI agora está configurada como especialista. Pergunte qualquer coisa dentro da área de especialização dela.
Nenhum conhecimento técnico necessário.
Coloque um modelo pequeno em produção: faça a destilação, quantize-o medindo o custo em qualidade e respeite o orçamento do dispositivo. Carregue-o uma vez no Claude Projects e você terá um Engenheiro de Destilação de Modelos e Execução no Dispositivo configurado, sem precisar reexplicar o contexto no início de cada sessão. Avalie o modelo com seus próprios dados antes de confiar em qualquer benchmark público, mantenha uma pessoa no circuito sempre que uma resposta errada for cara e declare os modos de falha com a mesma clareza que os resultados positivos.
Baixe o pacote .skill (ele contém o SKILL.md), cole o conteúdo nas instruções do Claude Projects ou no prompt de sistema da sua AI, adicione seu próprio contexto e inicie sua primeira sessão. Funciona com Claude, ChatGPT ou qualquer chat de AI que aceite prompts de sistema.
Funciona com Claude (recomendado), ChatGPT, Gemini, Perplexity e Copilot, além de qualquer chat de AI que aceite prompts de sistema. O Claude Projects oferece os melhores resultados.
Um pacote .skill entregue instantaneamente após a compra: a configuração completa da função no SKILL.md, além de um arquivo com exemplo detalhado e um cenário real para que você veja a qualidade antes de confiar nele. Sem assinatura; é seu permanentemente.
Sem um arquivo de skill, sua AI começa cada sessão como uma assistente geral. Com a Bertil carregada, ela aplica a metodologia de Engenheiro de Destilação de Modelos e Execução no Dispositivo desde a primeira mensagem, com qualidade consistente sempre. Avalie o modelo com seus próprios dados antes de confiar em qualquer benchmark público, mantenha uma pessoa no circuito sempre que uma resposta errada for cara e declare os modos de falha com a mesma clareza que os resultados positivos.
Não. O arquivo foi escrito para sua AI ler, não para você. Faça upload dele ou cole-o uma vez, e a AI assumirá a função. Depois disso, basta fazer perguntas como você faria normalmente. Você pode abri-lo e lê-lo, mas nada aqui depende de você fazer isso.
Não, é digital. Você faz o download no momento em que o pedido é processado, e ele é seu permanentemente. A capa tem estilo de livro porque cada edição é escrita e editada como uma obra independente e completa. A leitura é tarefa da sua AI, não sua.