Bertil - Skill AI per ingegnere dell'AI edge
# Bertil - Specialista in distillazione dei modelli e uso sui dispositivi
## Chi è Bertil
Inserisci Bertil in Claude e ottieni uno specialista in distillazione dei modelli e uso dei modelli sui dispositivi che considera il telefono nelle mani del tecnico come il vero obiettivo di distribuzione e ogni numero come qualcosa che deve essere misurato su quel telefono anziché dedotto da una classifica. Bertil parte da tre ipotesi che resistono al contatto con la realtà: un benchmark generale non dice quasi nulla sul fatto che un modello a 4 bit continui a estrarre gli undici campi dell'ordine di lavoro, una cifra di token al secondo rilevata nei primi trenta secondi di un'esecuzione non dice nulla sul sesto minuto e "sta nella RAM" non equivale ad affermare che il sistema operativo consentirà alla tua app di mantenerlo lì. Misura lo studente rispetto all'insegnante sul compito specifico del cliente, con la quantizzazione del cliente e sul dispositivo peggiore del cliente.
Bertil copre l'intero percorso, da un modello grande che funziona a un modello piccolo pronto per la distribuzione:
generazione dell'output dell'insegnante e supervisione delle motivazioni, distillazione di risposte, logit e stati nascosti, selezione e dimensionamento dello studente specifici per l'attività, potatura e sparsità laddove offrono effettivi vantaggi, addestramento LoRA e fusione degli adapter, procedure di quantizzazione con matrici di importanza calibrate sul testo del dominio, selezione e conversione dell'ambiente di esecuzione tra llama.cpp,
MLX, Core ML, ONNX Runtime e LiteRT, budget di memoria, temperatura e batteria misurati
sul dispositivo effettivo anziché sulla scrivania.
Caricato il file, rivolgiti a lui per nome: «Serge, guarda questa pagina.» Il nome serve a questo. Cosi tieni distinti piu skill nella stessa chat.
Sei Bertil, un ingegnere specializzato nella distillazione dei modelli e nell'esecuzione on-device, che valuta uno studente rispetto al suo insegnante sul task del cliente, con la quantizzazione scelta dal cliente e sul suo dispositivo peggiore. Sei stato attivato per distribuire un modello di piccole dimensioni.
$4.92/mese, fatturato annualmente. Funziona in Claude, ChatGPT, Claude Code, Codex e Cursor. Disdici quando vuoi, rimborso di 14 giorni sul primo addebito. Dopo l’acquisto ti mandiamo il link di configurazione.
Pacchetto skill completo download immediatodistillazione del modello Bertil sul dispositivo.md
Paghi una volta, tuo per sempreDownload immediatoSoddisfatti o rimborsati 30 giorni
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Bertil something hard.
Oppure tutti gli skill, dentro la tua IA.
Domande prima di comprare? Risponde una persona, di solito in giornata: hello@kissmyskills.com
// what's inside
Cosa c'è dentro questa abilità
- Distillazione della risposta, delle funzionalità e della motivazione da parte di un insegnante
- INT8/INT4, GPTQ, AWQ e GGUF con costo in termini di qualità misurato
- llama.cpp, MLX, Core ML, ONNX e TFLite su hardware reale
- Budget di memoria, temperatura e batteria; strategie di escalation ibride
Team che hanno bisogno di un modello in esecuzione offline o sul dispositivo, senza sacrificare un’accuratezza che non hanno misurato.
What you're actually buying
Inserisci Bertil in Claude e ottieni un ingegnere della distillazione che misura il costo in termini di qualità di ogni passaggio di quantizzazione invece di presumere che INT4 sia gratuito.
Bertil rende un modello piccolo sufficientemente efficace e lo porta sul dispositivo: distillazione della conoscenza da un modello insegnante di grandi dimensioni attraverso la distillazione di risposte, caratteristiche e motivazioni; modelli linguistici piccoli e specifici per attività; quantizzazione con INT8, INT4, GPTQ, AWQ e GGUF, misurando il costo in termini di qualità anziché darlo per scontato; potatura e sparsità; fusione di LoRA e adattatori; ambienti di esecuzione sul dispositivo, tra cui llama.cpp, MLX, ONNX Runtime, Core ML e TFLite; limiti di memoria, temperatura e batteria su hardware reale; latenza su chip mobili ed edge; il modello ibrido in cui un modello piccolo gestisce il percorso comune e inoltra il resto a un modello più grande; funzionalità offline e distribuzione degli aggiornamenti; e una valutazione onesta rispetto al modello insegnante sulle attività che contano.
Cosa ottieni
- →Distillazione di risposte, caratteristiche e motivazioni da un modello insegnante
- →INT8/INT4, GPTQ, AWQ e GGUF con il costo in termini di qualità misurato
- →llama.cpp, MLX, Core ML, ONNX e TFLite su hardware reale
- →Limiti di memoria, temperatura e batteria; strategie di escalation ibride
Come installare
Scarica il pacchetto .skill → apri Claude → incolla SKILL.md nelle Istruzioni del progetto o nel prompt di sistema → descrivi il tuo requisito → Bertil crea la risposta. Include un esempio completo e svolto, così puoi vedere esattamente cosa ottieni.
Quattro passaggi. Qualsiasi chat AI.
- 01Scarica il file
Dopo il pagamento, il link per il download arriverà nella tua casella di posta. Salva il file in qualsiasi posizione sul tuo dispositivo.
- 02Apri la tua chat AI
Claude, ChatGPT, Gemini, Grok o Copilot: qualunque sia quello che usi già.
- 03Incolla il contenuto del file
Inseriscilo nel prompt di sistema, nelle istruzioni del progetto o nel campo delle istruzioni personalizzate.
- 04Inizia a lavorare
La tua AI è ora configurata come specialista. Chiedile qualsiasi cosa nell’ambito di sua competenza.
Non è richiesta alcuna conoscenza tecnica.
Con Unlimited non c’è niente da scaricare. Collega la tua IA una volta, poi chiedi: «Carica Bertil da KissMySkills».
Guida alla configurazione → Unlimited · $4.92/mese con il piano annuale →
Domande su questo prodotto
Cosa fa la skill Bertil?+
Fa arrivare un piccolo modello alla fase di distribuzione: lo distilla, lo quantizza misurando il costo in termini di qualità e rispetta il budget del dispositivo. Caricala una volta in Claude Projects e ottieni un Model Distillation & On-Device Engineer configurato, senza dover rispiegare il contesto all'inizio di ogni sessione. Misura il modello sui tuoi dati prima di fidarti di qualsiasi benchmark pubblico, mantieni una persona nel ciclo decisionale ogni volta che una risposta errata ha costi elevati e dichiara i casi di errore con la stessa chiarezza dei successi.
Come installo questo file della skill?+
Scarica il pacchetto .skill (contiene SKILL.md), incolla il contenuto nelle Istruzioni di Claude Projects o nel prompt di sistema della tua AI, aggiungi il tuo contesto e avvia la prima sessione. Funziona con Claude, ChatGPT o qualsiasi chat AI che accetti prompt di sistema.
Con quali strumenti di AI funziona questa skill?+
Funziona con Claude (consigliato), ChatGPT, Gemini, Perplexity e Copilot, oltre che con qualsiasi chat AI che accetti prompt di sistema. Claude Projects offre i risultati migliori.
Cosa include questo download?+
Un pacchetto .skill consegnato istantaneamente dopo l'acquisto: la configurazione completa del ruolo in SKILL.md, più un file con un esempio pratico e uno scenario reale, così puoi vedere la qualità prima di affidarti a questo strumento. Nessun abbonamento: è tuo per sempre.
In cosa differisce dall'utilizzare Claude senza la skill Bertil?+
Senza un file della skill, la tua AI inizia ogni sessione come assistente generico. Con Bertil caricato, applica la metodologia Model Distillation & On-Device Engineer fin dal primo messaggio, con una qualità coerente ogni volta. Misura il modello sui tuoi dati prima di fidarti di qualsiasi benchmark pubblico, mantieni una persona nel ciclo decisionale ogni volta che una risposta errata ha costi elevati e dichiara i casi di errore con la stessa chiarezza dei successi.
Devo leggerlo personalmente?+
No. Il file è scritto perché lo legga la tua AI, non tu. Caricalo o incollalo una volta e l'AI assumerà il ruolo. Dopodiché ti basterà porle domande come fai normalmente. Puoi aprirlo e leggerlo, se vuoi, ma nulla di ciò che contiene dipende dal fatto che tu lo faccia.