This skill as a file
$7 one payment, yours forever
- Download right after checkout, keep it for good
- Paste it into ChatGPT, Claude, Gemini or any AI chat, free plans included
- 30-day money-back guarantee
# Bertil - Specialista in distillazione dei modelli e uso sui dispositivi
## Chi è Bertil
Inserisci Bertil in Claude e ottieni uno specialista in distillazione dei modelli e uso dei modelli sui dispositivi che considera il telefono nelle mani del tecnico come il vero obiettivo di distribuzione e ogni numero come qualcosa che deve essere misurato su quel telefono anziché dedotto da una classifica. Bertil parte da tre ipotesi che resistono al contatto con la realtà: un benchmark generale non dice quasi nulla sul fatto che un modello a 4 bit continui a estrarre gli undici campi dell'ordine di lavoro, una cifra di token al secondo rilevata nei primi trenta secondi di un'esecuzione non dice nulla sul sesto minuto e "sta nella RAM" non equivale ad affermare che il sistema operativo consentirà alla tua app di mantenerlo lì. Misura lo studente rispetto all'insegnante sul compito specifico del cliente, con la quantizzazione del cliente e sul dispositivo peggiore del cliente.
Bertil copre l'intero percorso, da un modello grande che funziona a un modello piccolo pronto per la distribuzione:
generazione dell'output dell'insegnante e supervisione delle motivazioni, distillazione di risposte, logit e stati nascosti, selezione e dimensionamento dello studente specifici per l'attività, potatura e sparsità laddove offrono effettivi vantaggi, addestramento LoRA e fusione degli adapter, procedure di quantizzazione con matrici di importanza calibrate sul testo del dominio, selezione e conversione dell'ambiente di esecuzione tra llama.cpp,
MLX, Core ML, ONNX Runtime e LiteRT, budget di memoria, temperatura e batteria misurati
sul dispositivo effettivo anziché sulla scrivania.
Sei Bertil, un ingegnere specializzato nella distillazione dei modelli e nell'esecuzione on-device, che valuta uno studente rispetto al suo insegnante sul task del cliente, con la quantizzazione scelta dal cliente e sul suo dispositivo peggiore. Sei stato attivato per distribuire un modello di piccole dimensioni.
Pacchetto skill completo download immediatodistillazione del modello Bertil sul dispositivo.md
Paghi una volta, tuo per sempreDownload immediatoSoddisfatti o rimborsati 30 giorni
Oppure tutti i 2,300+ skill, prompt e agenti con Unlimited Access · $9/mese →
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Bertil something hard.
Domande prima dell’acquisto?
Domande prima dell’acquisto?
Scrivici e ti risponderà una persona, di solito lo stesso giorno. Non un bot, non una coda di ticket.
hello@kissmyskills.com// what's inside
Team che hanno bisogno di un modello in esecuzione offline o sul dispositivo, senza sacrificare un’accuratezza che non hanno misurato.
// two ways to get it
$7 one payment, yours forever
$9/mo cancel anytime, or $99 a year
Subscribers can still buy single files and keep them after they cancel.
Inserisci Bertil in Claude e ottieni un ingegnere della distillazione che misura il costo in termini di qualità di ogni passaggio di quantizzazione invece di presumere che INT4 sia gratuito.
Bertil rende un modello piccolo sufficientemente efficace e lo porta sul dispositivo: distillazione della conoscenza da un modello insegnante di grandi dimensioni attraverso la distillazione di risposte, caratteristiche e motivazioni; modelli linguistici piccoli e specifici per attività; quantizzazione con INT8, INT4, GPTQ, AWQ e GGUF, misurando il costo in termini di qualità anziché darlo per scontato; potatura e sparsità; fusione di LoRA e adattatori; ambienti di esecuzione sul dispositivo, tra cui llama.cpp, MLX, ONNX Runtime, Core ML e TFLite; limiti di memoria, temperatura e batteria su hardware reale; latenza su chip mobili ed edge; il modello ibrido in cui un modello piccolo gestisce il percorso comune e inoltra il resto a un modello più grande; funzionalità offline e distribuzione degli aggiornamenti; e una valutazione onesta rispetto al modello insegnante sulle attività che contano.
Cosa ottieni
Come installare
Scarica il pacchetto .skill → apri Claude → incolla SKILL.md nelle Istruzioni del progetto o nel prompt di sistema → descrivi il tuo requisito → Bertil crea la risposta. Include un esempio completo e svolto, così puoi vedere esattamente cosa ottieni.
Dopo il pagamento, il link per il download arriverà nella tua casella di posta. Salva il file in qualsiasi posizione sul tuo dispositivo.
Claude, ChatGPT, Gemini, Grok o Copilot: qualunque sia quello che usi già.
Inseriscilo nel prompt di sistema, nelle istruzioni del progetto o nel campo delle istruzioni personalizzate.
La tua AI è ora configurata come specialista. Chiedile qualsiasi cosa nell’ambito di sua competenza.
Non è richiesta alcuna conoscenza tecnica.
Fa arrivare un piccolo modello alla fase di distribuzione: lo distilla, lo quantizza misurando il costo in termini di qualità e rispetta il budget del dispositivo. Caricala una volta in Claude Projects e ottieni un Model Distillation & On-Device Engineer configurato, senza dover rispiegare il contesto all'inizio di ogni sessione. Misura il modello sui tuoi dati prima di fidarti di qualsiasi benchmark pubblico, mantieni una persona nel ciclo decisionale ogni volta che una risposta errata ha costi elevati e dichiara i casi di errore con la stessa chiarezza dei successi.
Scarica il pacchetto .skill (contiene SKILL.md), incolla il contenuto nelle Istruzioni di Claude Projects o nel prompt di sistema della tua AI, aggiungi il tuo contesto e avvia la prima sessione. Funziona con Claude, ChatGPT o qualsiasi chat AI che accetti prompt di sistema.
Funziona con Claude (consigliato), ChatGPT, Gemini, Perplexity e Copilot, oltre che con qualsiasi chat AI che accetti prompt di sistema. Claude Projects offre i risultati migliori.
Un pacchetto .skill consegnato istantaneamente dopo l'acquisto: la configurazione completa del ruolo in SKILL.md, più un file con un esempio pratico e uno scenario reale, così puoi vedere la qualità prima di affidarti a questo strumento. Nessun abbonamento: è tuo per sempre.
Senza un file della skill, la tua AI inizia ogni sessione come assistente generico. Con Bertil caricato, applica la metodologia Model Distillation & On-Device Engineer fin dal primo messaggio, con una qualità coerente ogni volta. Misura il modello sui tuoi dati prima di fidarti di qualsiasi benchmark pubblico, mantieni una persona nel ciclo decisionale ogni volta che una risposta errata ha costi elevati e dichiara i casi di errore con la stessa chiarezza dei successi.
No. Il file è scritto perché lo legga la tua AI, non tu. Caricalo o incollalo una volta e l'AI assumerà il ruolo. Dopodiché ti basterà porle domande come fai normalmente. Puoi aprirlo e leggerlo, se vuoi, ma nulla di ciò che contiene dipende dal fatto che tu lo faccia.