LLMOps / Inference Engineer Claude skill by KissMySkills, hardcover volume cover

Dario - LLMOps- / Inferenzingenieur AI Skill

$29.00
Angebotspreis  $29.00 Regulärer Preis  $43.99
Zu den Produktinformationen springen
LLMOps / Inference Engineer Claude skill by KissMySkills, hardcover volume cover

Dario - LLMOps- / Inferenzingenieur AI Skill

$29.00 dieser Skill vs $43.99 a senior LLMOps engineer beauftragen

Komplettes Skill-Paket Sofort-Downloaddario-llmops-inference-engineer.skill

  • American Express
  • Apple Pay
  • BLIK
  • Google Pay
  • Klarna
  • Maestro
  • Mastercard
  • PayPal
  • Union Pay
  • Visa

Secure checkout by Shopify

Ask Dario something hard.

📎 dario-llmops-inference-engineer.md LOADED ✓
Richte einen produktionsreifen LLM-Endpunkt ein, der ein p95-Latenz-SLO erfüllt, und senke unsere Kosten pro Anfrage.
CLAUDE · AS DARIO, LLMOPS- / INFERENZINGENIEUR Dario liefert die Kapazitätsberechnung, eine echte vLLM- und LiteLLM-Gateway-Konfiguration mit Failover, einen Canary-Rollout-Plan, eine Dashboard- und Alert-Spezifikation sowie eine Vorher-Nachher-Tabelle (p95 und Kosten pro Anfrage sinken nach der Einführung von Continuous Batching und Prefix-Cache).
Sofortiger Download Für immer behalten Von uns verfasst

Add it once. Your AI works like a specialist.

Öffne es in Claude, ChatGPT oder Gemini - deine AI liest es und wird zum Spezialisten auf diesem Gebiet.

Sofortiger Download · 30 Tage Geld-zurück-Garantie. Einmal zahlen, dauerhaft nutzen - kein Abonnement. Von uns geschrieben und getestet, nie von GitHub kopiert. Rückerstattungsrichtlinie

Fragen vor dem Kauf?

Schreib uns, und eine echte Person antwortet - meistens noch am selben Tag. Kein Bot, keine Warteschlange.

hello@kissmyskills.com

Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.

Du liest es nicht. Deine AI tut es.

Übergeben Sie die Datei einmal an Claude, ChatGPT oder Gemini. Die KI liest sie, wird zum Spezialisten auf diesem Gebiet und antwortet ab der nächsten Nachricht als Dario.

Ein Kauf. Kein Abonnement. Die Datei gehört Ihnen und kann dauerhaft behalten und wiederverwendet werden.

// reviews

What buyers say.

From reviews across KissMySkills

★★★★★ Max T. on Nadia — Email Marketing Specialist
strategy consultant. client deliverables need to meet a high bar. this gets me to a usable first draft in a fraction of the time.
★★★★★ Karolina W. on Diane — Executive Assistant
product manager. used to spend too much time formatting and structuring. this gives me a consistent starting point every time.

// what's inside

What's inside this skill

  1. Inference-Optimierung: kontinuierliches Batching, KV-Cache, Quantisierung
  2. Ein LLM-Gateway: Routing, Fallbacks, Wiederholungsversuche, Ratenbegrenzungen
  3. Kapazitätsberechnung, automatische Skalierung und Präfix-/semantisches Caching
  4. Beobachtbarkeit (TTFT, p95, Kosten/Anfrage), SLOs und Canary-Rollout

Teams, die LLM-Funktionen in der Produktion einsetzen und Latenz, Zuverlässigkeit sowie Kosten unter Kontrolle halten müssen.

Ein leitender LLMOps-Ingenieur berechnet mehr als 140 $ pro Stunde - dies ist eine Datei, die für immer Ihnen gehört.

// was drin ist

What you're actually buying

Füge Dario in Claude ein und erhalte einen erfahrenen LLMOps-Ingenieur, der dein Modell wie einen von einem SRE verantworteten Dienst betreibt: mit SLOs, einem Gateway, Dashboards und einem Rollback in einem Schritt.

Dario betreibt LLMs in der Produktion: Inference-Engines (vLLM, TGI, TensorRT-LLM), Verhältnis von Durchsatz zu Latenz (Continuous Batching, KV-Cache, Paged Attention, Speculative Decoding und Kompromisse bei der Quantisierung), ein LLM-Gateway (Routing, Fallbacks, Wiederholungsversuche, Timeouts, Raten- und Kontingentlimits sowie Schlüsselverwaltung), Autoscaling und GPU-Kapazitätsplanung, Caching (Präfix- und semantisches Caching), Zuverlässigkeit (Circuit Breaker und Failover über mehrere Anbieter hinweg), Observability (p50/p95/p99, TTFT, Tokens/Sekunde, Kosten pro Anfrage und Warnmeldungen) sowie Canary-/Shadow-Rollouts mit SLOs und Error Budgets. Tools wie vLLM, LiteLLM, KServe, Prometheus, Grafana und Langfuse - ohne Vendor-Lock-in. Führe den Rollout zunächst per Canary in der Staging-Umgebung durch.

Das bekommst du

  • Inference-Tuning: Continuous Batching, KV-Cache und Quantisierung
  • Ein LLM-Gateway: Routing, Fallbacks, Wiederholungsversuche und Ratenbegrenzungen
  • Kapazitätsberechnung, Autoscaling sowie Präfix- und semantisches Caching
  • Observability (TTFT, p95, Kosten/Anfrage), SLOs und Canary-Rollout
📄 dario-llmops-inference-engineer.skill Installation in weniger als 2 Minuten Funktioniert mit Claude, ChatGPT & jedem AI-Chat

So installierst du es

Lade das .skill-Paket herunter → öffne Claude → füge SKILL.md in deine Projektanweisungen oder deinen System-Prompt ein → beschreibe deine Anforderungen → Dario erstellt die Antwort. Enthält ein vollständiges Beispiel, damit du genau siehst, was du erhältst.

dario-llmops-inference-engineer.skill
# Dario - LLMOps- / Inference-Engineer

Du bist Dario, ein Senior-LLMOps-/Inference-Engineer. Du betreibst das Modell wie einen von einem SRE verantworteten Dienst: SLO an erster Stelle, Dashboards und Rollback in einem Schritt.

## So arbeitest du
1. SLO festlegen; die Kapazitätsberechnung offen darlegen
2. Effizient bereitstellen (Batching, KV-Cache, Quantisierung)
3. Ein Gateway vorschalten (Routing, Fallbacks, Ratenbegrenzungen)
4. Dashboards und Alarme hinzufügen; per Canary ausrollen; Rollback beibehalten

Führe Rollouts immer zuerst per Shadow- oder Canary-Deployment in der Staging-Umgebung durch und halte einen Rollback in einem Schritt bereit.

Auszug aus der tatsächlichen Datei, die Sie herunterladen werden.

// installation Unter 2 Minuten

Vier Schritte. Jeder AI-Chat.

  1. 01
    Datei herunterladen

    Nach dem Bezahlvorgang wird der Download-Link an deinen Posteingang gesendet. Speichere die Datei an einem beliebigen Ort auf deinem Gerät.

  2. 02
    Öffne deinen AI-Chat

    Claude, ChatGPT, Gemini, Grok oder Copilot - ganz gleich, welches du bereits verwendest.

  3. 03
    Füge den Dateiinhalt ein

    Füge es in das System-Prompt-, Projektanweisungen- oder Feld für benutzerdefinierte Anweisungen ein.

  4. 04
    Beginne mit der Arbeit

    Ihre AI ist jetzt als Spezialist konfiguriert. Fragen Sie sie alles innerhalb ihres Fachgebiets.

Keine technischen Kenntnisse erforderlich. Kein Abonnement. Einmal bezahlen, für immer behalten.

// kompatibel mit

Funktioniert mit jedem großen AI-Chat.

Füge die Datei in den System-prompt deiner AI, die Projektanweisungen oder die benutzerdefinierten Anweisungen ein. Keine Einrichtung. Kein Code. Keine Anbieterbindung.

What buyers say across KissMySkills

This skill has no reviews of its own yet. These are real reviews of other KissMySkills skills, built the same way.

  • ★★★★★
    operations lead at a growing startup. we needed consistency across the team. this gave us a shared baseline to work from.

    Lukas B. on Nadia — Email Marketing Specialist

  • ★★★★★
    dropped Serena - Market Researcher AI Skill into Claude projects and it just works. writes campaign briefs, social post directions, monthly content outlines. the output doesnt need much editing which is the main thing.

    Sarah K. on Serena — Market Researcher

  • ★★★★★
    cfo at a professional services firm. the output structure matched what our board expects.

    Jan Z. on Nadia — Email Marketing Specialist

  • ★★★★★
    product designer. needed a structured communication layer for cross-functional work. this provides it.

    Ewa A. on Serena — Market Researcher

  • ★★★★★
    investment analyst. the analytical structure matches what i need for client-facing documents.

    Joanna Y. on Diane — Executive Assistant

  • ★★★★★
    hr business partner at a 200-person organisation. the structured outputs made it easier to standardise documentation quality.

    Rachel M. on Nadia — Email Marketing Specialist

// faq

Fragen zu diesem Produkt

Was macht der Dario-Skill?+

LLMs in der Produktion betreiben: Bereitstellung, Gateway, automatische Skalierung, Caching, Dashboards und ein durch SLOs gesteuerter Rollout. Lade ihn einmal in Claude Projects und du erhältst einen konfigurierten LLMOps- / Inference Engineer, ohne den Kontext zu Beginn jeder Sitzung erneut erklären zu müssen. Erstelle ein Entwicklungs- oder Staging-Umgebung gegenüber einem zurückgehaltenen Testsatz und evaluiere sie, füge Schutzmechanismen, Kosten- und Ratenlimits sowie menschliche Überprüfung hinzu und führe sie erst nach Evaluierungen und Monitoring ausgerollt aus, bevor du Agents oder LLM-Funktionen in der Produktion bereitstellst.

Wie installiere ich diese Skill-Datei?+

Lade das .skill-Paket herunter (es enthält SKILL.md), füge den Inhalt in die Anweisungen von Claude Projects oder den System-Prompt deiner AI ein, ergänze deinen eigenen Kontext und starte deine erste Sitzung. Funktioniert mit Claude, ChatGPT oder jedem AI-Chat, der System-Prompts akzeptiert.

Mit welchen AI-Tools funktioniert dieser Skill?+

Funktioniert mit Claude (empfohlen), ChatGPT, Gemini, Perplexity und Copilot sowie jedem AI-Chat, der System-Prompts akzeptiert. Mit Claude Projects erzielst du die besten Ergebnisse.

Was ist in diesem Download enthalten?+

Ein .skill-Paket, das sofort nach dem Kauf bereitgestellt wird: die vollständige SKILL.md-Rollenkonfiguration sowie eine Beispieldatei mit einem realen Szenario, damit du die Qualität siehst, bevor du dich darauf verlässt. Kein Abonnement, dauerhaft deins.

Wie unterscheidet sich das von der Nutzung von Claude ohne den Dario-Skill?+

Ohne Skill-Datei startet deine AI jede Sitzung als allgemeiner Assistent. Mit geladenem Dario wendet sie ab der ersten Nachricht eine LLMOps- / Inference-Engineer-Methodik an - jedes Mal mit gleichbleibender Qualität. Erstelle eine Entwicklungs- oder Staging-Umgebung gegenüber einem zurückgehaltenen Testsatz und evaluiere sie, füge Schutzmechanismen, Kosten- und Ratenlimits sowie menschliche Überprüfung hinzu und führe sie erst nach Evaluierungen und Monitoring ausgerollt aus, bevor du Agents oder LLM-Funktionen in der Produktion bereitstellst.

Muss ich die Datei selbst lesen?+

Nein. Die Datei wurde für deine AI geschrieben, nicht für dich. Lade sie hoch oder füge sie einmal ein, und die AI übernimmt die Rolle. Danach stellst du ihr einfach wie gewohnt Fragen. Du kannst sie gern öffnen und lesen, aber nichts hier setzt voraus, dass du das tust.

Ist das ein physisches Buch?+

Nein, es ist digital. Du lädst es sofort nach Abschluss der Bestellung herunter, und es gehört dir dauerhaft. Das Cover ist wie ein Buch gestaltet, weil jede Ausgabe als eigenständiges, in sich geschlossenes Werk geschrieben und redigiert wurde. Das Lesen übernimmt deine AI, nicht du.

Bereit, deine AI zu spezialisieren?

Eine sofort einsatzbereite Datei. Einmal bezahlen, für immer behalten - funktioniert mit Claude & ChatGPT.

Mehr aus diesem Regal

Anselma - Skill für den Chief AI Officer

Anselma - Skill für den Chief AI Officer

Anselma - Skill für den Chief AI Officer

$29.00
Angebotspreis  $29.00 Regulärer Preis  $43.99
Hektor - Skill für AI-Vertrauen und Sicherheit

Hektor - Skill für AI-Vertrauen und Sicherheit

Hektor - Skill für AI-Vertrauen und Sicherheit

$29.00
Angebotspreis  $29.00 Regulärer Preis  $43.99
Fabrizio - Skill für AI-Forward-Deployed-Engineering

Fabrizio - Skill für AI-Forward-Deployed-Engineering

Fabrizio - Skill für AI-Forward-Deployed-Engineering

$29.00
Angebotspreis  $29.00 Regulärer Preis  $43.99
Odalric - Skill für AI-Forschungsengineering

Odalric - Skill für AI-Forschungsengineering

Odalric - Skill für AI-Forschungsengineering

$29.00
Angebotspreis  $29.00 Regulärer Preis  $43.99