Bertil - Edge-AI-Ingenieur Skill
# Bertil - Engineer für Modelldestillation und On-Device-Bereitstellung ## Wer Bertil ist Integriere Bertil in Claude und erhalte einen Engineer für Modelldestillation und On-Device-Bereitstellung, der das Telefon in der Hand des Technikers als tatsächliches Bereitstellungsziel betrachtet und jede Zahl als etwas behandelt, das auf diesem Telefon gemessen werden muss, statt sie aus einer Bestenliste abzuleiten. Bertil geht von drei Annahmen aus, die sich in der Realität bewähren: Ein allgemeiner Benchmark sagt fast nichts darüber aus, ob ein 4-Bit-Modell noch deine elf Felder aus Arbeitsaufträgen extrahiert, ein Tokens-pro-Sekunde-Wert aus den ersten dreißig Sekunden eines Laufs sagt nichts über Minute sechs aus, und „es passt in den RAM“ ist nicht dasselbe wie die Aussage „das Betriebssystem lässt deine App es dort behalten“. Er misst den Schüler am Lehrer anhand der eigenen Aufgabe des Kunden, mit der Quantisierung des Kunden und auf dem schlechtesten Gerät des Kunden. Bertil deckt den gesamten Weg von einem funktionierenden großen Modell bis zu einem kleinen, auslieferbaren Modell ab: Erzeugung von Lehrerausgaben und Begründungs-Supervision, Antwort-, Logit- und Hidden-State-Destillation, Auswahl und Dimensionierung aufgabenspezifischer Schüler, Pruning und Sparsität, wo sie sich tatsächlich lohnen, LoRA-Training und das Zusammenführen von Adaptern, Quantisierungsrezepte mit anhand von Domänentext kalibrierten Wichtigkeitsmatrizen, Auswahl und Konvertierung der Laufzeitumgebung für llama.cpp, MLX, Core ML, ONNX Runtime und LiteRT sowie gemessene Speicher-, Wärme- und Akkubudgets
Wenn die Datei geladen ist, sprich es mit Namen an: „Serge, sieh dir diese Seite an.“ Dafuer ist der Name da. So bleiben auch mehrere Skills in einem Chat auseinander.
Du bist Bertil, ein Ingenieur für Modelldestillation und On-Device-Systeme, der ein Schüler-Modell anhand der Aufgaben des Kunden, mit der Quantisierung des Kunden und auf dessen leistungsschwächstem Gerät mit seinem Lehrer-Modell vergleicht. Du wurdest aktiviert, um ein kleines Modell auszuliefern.
$4.92/Monat, jährlich abgerechnet. Funktioniert in Claude, ChatGPT, Claude Code, Codex und Cursor. Jederzeit kündbar, 14 Tage Erstattung auf die erste Zahlung. Nach dem Kauf mailen wir dir den Setup-Link.
Komplettes Skill-Paket Sofort-DownloadBertil-Modell-Destillation auf dem Gerät-Fähigkeit
Einmal zahlen, für immer behaltenSofort-Download30 Tage Geld-zurück-Garantie
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Bertil something hard.
Oder jeden Skill direkt in deiner KI.
Fragen vor dem Kauf? Ein Mensch antwortet, meist am selben Tag: hello@kissmyskills.com
// what's inside
Was steckt in dieser Fähigkeit?
- Destillation von Antwort, Funktion und Begründung durch einen Lehrer
- INT8/INT4, GPTQ, AWQ und GGUF mit gemessenen Qualitätseinbußen
- llama.cpp, MLX, Core ML, ONNX und TFLite auf echter Hardware
- Speicher-, Wärme- und Akkubudgets; hybride Eskalationsmuster
Teams, die ein Modell offline oder auf dem Gerät ausführen müssen, ohne dafür bei der Genauigkeit Abstriche zu machen, die sie nicht gemessen haben.
What you're actually buying
Füge Bertil in Claude ein und erhalte einen Destillationsingenieur, der die Qualitätseinbußen jedes Quantisierungsschritts misst, statt anzunehmen, dass INT4 kostenlos ist.
Bertil macht ein kleines Modell leistungsfähig genug und bringt es auf das Gerät: Wissensdestillation von einem großen Teacher-Modell über Antwort-, Feature- und Begründungs-Destillation; aufgabenspezifische kleine Sprachmodelle; Quantisierung mit INT8, INT4, GPTQ, AWQ und GGUF, wobei die Qualitätseinbußen gemessen und nicht angenommen werden; Pruning und Sparsität; LoRA und das Zusammenführen von Adaptern; On-Device-Runtimes einschließlich llama.cpp, MLX, ONNX Runtime, Core ML und TFLite; Speicher-, Wärme- und Akku-Budgets auf echter Hardware; Latenz auf mobilen Geräten und Edge-Chips; das hybride Muster, bei dem ein kleines Modell den häufigen Pfad übernimmt und den Rest eskaliert; Offline-Fähigkeit und Update-Verteilung; sowie eine ehrliche Bewertung gegenüber dem Teacher-Modell anhand der relevanten Aufgaben.
Das bekommst du
- →Antwort-, Feature- und Begründungs-Destillation von einem Teacher-Modell
- →INT8/INT4, GPTQ, AWQ und GGUF mit gemessenen Qualitätseinbußen
- →llama.cpp, MLX, Core ML, ONNX und TFLite auf echter Hardware
- →Speicher-, Wärme- und Akku-Budgets; hybride Eskalationsmuster
So installierst du es
Lade das .skill-Paket herunter → öffne Claude → füge SKILL.md in deine Projektanweisungen oder deinen System-Prompt ein → beschreibe deine Anforderungen → Bertil erstellt die Antwort. Enthält ein vollständiges durchgearbeitetes Beispiel, damit du genau siehst, was du bekommst.
Vier Schritte. Jeder AI-Chat.
- 01Datei herunterladen
Nach dem Bezahlvorgang wird der Download-Link an deinen Posteingang gesendet. Speichere die Datei an einem beliebigen Ort auf deinem Gerät.
- 02Öffne deinen AI-Chat
Claude, ChatGPT, Gemini, Grok oder Copilot – ganz egal, welches du bereits nutzt.
- 03Fügen Sie den Dateiinhalt ein
Füge es in das Feld für den System-Prompt, die Projektanweisungen oder die benutzerdefinierten Anweisungen ein.
- 04Beginne mit der Arbeit
Deine AI ist jetzt als Spezialist konfiguriert. Frag sie alles innerhalb ihres Fachgebiets.
Keine technischen Kenntnisse erforderlich.
Mit Unlimited gibt es nichts herunterzuladen. Verbinde deine KI einmal und bitte sie dann einfach: „Lade Bertil von KissMySkills.“
Setup-Anleitung → Unlimited · $4.92/Monat bei jährlicher Zahlung →
Fragen zu diesem Produkt
Was macht der Bertil-Skill?+
Ein kleines Modell produktionsreif machen: Es destillieren, mit gemessenen Qualitätseinbußen quantisieren und das Gerätebudget einhalten. Lade es einmal in Claude Projects und du erhältst einen konfigurierten Model-Distillation-&-On-Device-Engineer, ohne den Kontext zu Beginn jeder Sitzung erneut erklären zu müssen. Miss das Modell mit deinen eigenen Daten, bevor du einem öffentlichen Benchmark vertraust, behalte überall dort einen Menschen in der Entscheidungsschleife, wo eine falsche Antwort kostspielig ist, und benenne die Fehlerfälle ebenso klar wie die Erfolge.
Wie installiere ich diese Skill-Datei?+
Lade das .skill-Paket herunter (es enthält SKILL.md), füge den Inhalt in die Anweisungen von Claude Projects oder den System-Prompt deiner AI ein, ergänze deinen eigenen Kontext und starte deine erste Sitzung. Funktioniert mit Claude, ChatGPT oder jedem AI-Chat, der System-Prompts akzeptiert.
Mit welchen AI-Tools funktioniert dieser Skill?+
Funktioniert mit Claude (empfohlen), ChatGPT, Gemini, Perplexity und Copilot sowie mit jedem AI-Chat, der System-Prompts akzeptiert. Mit Claude Projects erzielst du die besten Ergebnisse.
Was ist in diesem Download enthalten?+
Ein .skill-Paket, das du sofort nach dem Kauf erhältst: die vollständige SKILL.md-Rollenkonfiguration sowie eine Datei mit einem ausgearbeiteten Beispiel und einem realen Szenario, damit du die Qualität siehst, bevor du dich darauf verlässt. Kein Abonnement, dauerhaft dein Eigentum.
Worin unterscheidet sich das von der Nutzung von Claude ohne den Bertil-Skill?+
Ohne eine Skill-Datei startet deine AI jede Sitzung als allgemeiner Assistent. Mit geladenem Bertil wendet sie ab der ersten Nachricht die Methodik eines Model-Distillation-&-On-Device-Engineers an, mit gleichbleibender Qualität in jeder Sitzung. Miss das Modell mit deinen eigenen Daten, bevor du einem öffentlichen Benchmark vertraust, behalte überall dort einen Menschen in der Entscheidungsschleife, wo eine falsche Antwort kostspielig ist, und benenne die Fehlerfälle ebenso klar wie die Erfolge.
Muss ich es selbst lesen?+
Nein. Die Datei wurde für deine AI geschrieben, nicht für dich. Lade sie hoch oder füge sie einmal ein, und die AI übernimmt die Rolle. Danach stellst du ihr einfach Fragen, wie du es normalerweise tun würdest. Du kannst sie gern öffnen und lesen, aber nichts hier setzt voraus, dass du das tust.
Ist das ein gedrucktes Buch?+
Nein, es ist digital. Du lädst es herunter, sobald die Bestellung abgeschlossen ist, und es bleibt dauerhaft dein Eigentum. Das Cover ist wie ein Buch gestaltet, weil jede Ausgabe als eigenständiges, in sich abgeschlossenes Werk geschrieben und bearbeitet wird. Das Lesen übernimmt deine AI, nicht du.