Dario - Skill AI per ingegneria LLMOps / dell'inferenza
Pacchetto skill completo download immediatodario-llmops-inference-engineer.skill
Secure checkout by Shopify
Ask Dario something hard.
Add it once. Your AI works like a specialist.
Aprilo in Claude, ChatGPT o Gemini: la tua AI lo legge e diventa specialista in questo campo.
Download immediato · Garanzia soddisfatti o rimborsati di 30 giorni. Paga una volta, conservailo per sempre - nessun abbonamento. Scritto e testato da noi, mai estratto da GitHub. Politica di rimborso
Domande prima dell’acquisto?
Scrivici e ti risponderà una persona, di solito lo stesso giorno. Non un bot, né una coda di ticket.
hello@kissmyskills.comTrademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Non lo leggi tu. Lo fa la tua AI.
Consegna il file a Claude, ChatGPT o Gemini una sola volta. Lo leggerà, diventerà uno specialista in questo campo e risponderà come Dario già dal messaggio successivo.
Un solo acquisto. Nessun abbonamento. Il file è tuo: puoi conservarlo e riutilizzarlo per sempre.
What buyers say.
From reviews across KissMySkills
strategy consultant. client deliverables need to meet a high bar. this gets me to a usable first draft in a fraction of the time.
product manager. used to spend too much time formatting and structuring. this gives me a consistent starting point every time.
// what's inside
What's inside this skill
- Ottimizzazione dell'inferenza: batching continuo, cache KV, quantizzazione
- Un gateway LLM: routing, fallback, tentativi, limiti di frequenza
- Calcolo della capacità, autoscaling e caching dei prefissi/semantico
- Osservabilità (TTFT, p95, costo/richiesta), SLO e rilascio canary
Team che portano in produzione funzionalità basate su LLM e hanno bisogno di tenere sotto controllo latenza, affidabilità e costi.
Un ingegnere LLMOps senior fattura oltre 140 $/ora; questo è un unico file, tuo per sempre.
What you're actually buying
Inserisci Dario in Claude e ottieni un ingegnere LLMOps senior che gestisce il tuo modello come un servizio di cui si occupa un SRE: SLO, un gateway, dashboard e rollback in un solo passaggio.
Dario distribuisce e gestisce LLM in produzione: motori di inferenza (vLLM, TGI, TensorRT-LLM), throughput rispetto alla latenza (batching continuo, cache KV, attenzione paginata, decodifica speculativa, compromessi della quantizzazione), un gateway LLM (routing, fallback, nuovi tentativi, timeout, limiti di frequenza e di quota, gestione delle chiavi), autoscaling e pianificazione della capacità GPU, caching (dei prefissi e semantico), affidabilità (circuit breaker, failover tra più provider), osservabilità (p50/p95/p99, TTFT, token/sec, costo per richiesta, avvisi) e rilascio canary/silent con SLO e budget di errore. Strumenti come vLLM, LiteLLM, KServe, Prometheus, Grafana e Langfuse, senza vincoli. Esegui prima il rilascio canary in staging.
Cosa ottieni
- →Ottimizzazione dell'inferenza: batching continuo, cache KV, quantizzazione
- →Un gateway LLM: routing, fallback, nuovi tentativi e limiti di frequenza
- →Calcoli della capacità, autoscaling e caching dei prefissi e semantico
- →Osservabilità (TTFT, p95, costo/richiesta), SLO e rilascio canary
Come installare
Scarica il pacchetto .skill → apri Claude → incolla SKILL.md nelle Istruzioni del progetto o nel prompt di sistema → descrivi il tuo requisito → Dario crea la risposta. Include un esempio completo e svolto, così puoi vedere esattamente cosa ottieni.
# Dario - Ingegnere LLMOps / Inference Sei Dario, un ingegnere senior LLMOps / Inference. Gestisci il modello come un servizio sotto la responsabilità dell’SRE: prima gli SLO, dashboard e rollback con un solo passaggio. ## Come lavori 1. Definisci lo SLO; esegui i calcoli della capacità a voce alta 2. Fornisci il servizio in modo efficiente (batching, cache KV, quantizzazione) 3. Anteponi un gateway (routing, fallback, limiti di frequenza) 4. Aggiungi dashboard e avvisi; esegui il rollout tramite canary; mantieni il rollback Esegui sempre il rollout prima tramite shadow/canary in staging e mantieni un rollback con un solo passaggio.
Estratto dal file effettivo che scaricherai.
Quattro passaggi. Qualsiasi chat AI.
- 01Scarica il file
Dopo il pagamento, il link per il download arriverà nella tua casella di posta. Salva il file in qualsiasi posizione sul tuo dispositivo.
- 02Apri la tua chat AI
Claude, ChatGPT, Gemini, Grok o Copilot - quello che usi già.
- 03Incolla il contenuto del file
Inseriscilo nel prompt di sistema, nelle istruzioni del progetto o nel campo delle istruzioni personalizzate.
- 04Inizia a lavorare
La tua AI è ora configurata come specialista. Chiedile qualsiasi cosa nell’ambito di sua competenza.
Non è richiesta alcuna conoscenza tecnica. Nessun abbonamento. Paghi una volta, lo mantieni per sempre.
Compatibile con tutte le principali chat AI.
Inserisci il file nel prompt di sistema della tua AI, nelle istruzioni del progetto o nelle istruzioni personalizzate. Nessuna configurazione. Nessun codice. Nessun vincolo con un fornitore.
What buyers say across KissMySkills
This skill has no reviews of its own yet. These are real reviews of other KissMySkills skills, built the same way.
-
★★★★★
operations lead at a growing startup. we needed consistency across the team. this gave us a shared baseline to work from.
-
★★★★★
dropped Serena - Market Researcher AI Skill into Claude projects and it just works. writes campaign briefs, social post directions, monthly content outlines. the output doesnt need much editing which is the main thing.
-
★★★★★
cfo at a professional services firm. the output structure matched what our board expects.
-
★★★★★
product designer. needed a structured communication layer for cross-functional work. this provides it.
-
★★★★★
investment analyst. the analytical structure matches what i need for client-facing documents.
-
★★★★★
hr business partner at a 200-person organisation. the structured outputs made it easier to standardise documentation quality.
Domande su questo prodotto
Che cosa fa la skill Dario?+
Gestisce gli LLM in produzione: serving, un gateway, autoscaling, caching, dashboard e rollout regolati dagli SLO. Caricala una volta in Claude Projects e avrai un LLMOps / Inference Engineer configurato, senza dover rispiegare il contesto all’inizio di ogni sessione. Crea e valuta il sistema rispetto a un set di test tenuto da parte in un ambiente di sviluppo o staging, aggiungi guardrail, limiti di costo e di frequenza e revisione umana, quindi esegui il rollout con eval e monitoraggio prima di servire agenti o funzionalità LLM in produzione.
Come installo questo file skill?+
Scarica il pacchetto .skill (contiene SKILL.md), incolla il contenuto nelle Istruzioni di Claude Projects o nel prompt di sistema della tua AI, aggiungi il tuo contesto e avvia la prima sessione. Funziona con Claude, ChatGPT o qualsiasi chat AI che accetti prompt di sistema.
Con quali strumenti AI funziona questa skill?+
Funziona con Claude (consigliato), ChatGPT, Gemini, Perplexity e Copilot, oltre che con qualsiasi chat AI che accetti prompt di sistema. Claude Projects offre i risultati migliori.
Che cosa include questo download?+
Un pacchetto .skill consegnato immediatamente dopo l’acquisto: la configurazione completa del ruolo in SKILL.md, più un file con un esempio pratico e uno scenario reale, così puoi vedere la qualità prima di farci affidamento. Nessun abbonamento: è tuo per sempre.
In che cosa si differenzia dall’usare Claude senza la skill Dario?+
Senza un file skill, la tua AI inizia ogni sessione come assistente generico. Con Dario caricato, applica la metodologia LLMOps / Inference Engineer fin dal primo messaggio, con una qualità costante ogni volta. Crea e valuta il sistema rispetto a un set di test tenuto da parte in un ambiente di sviluppo o staging, aggiungi guardrail, limiti di costo e di frequenza e revisione umana, quindi esegui il rollout con eval e monitoraggio prima di servire agenti o funzionalità LLM in produzione.
Devo leggerlo personalmente?+
No. Il file è scritto per essere letto dalla tua AI, non da te. Caricalo o incollalo una volta e l’AI assumerà il ruolo. Dopodiché ti basterà farle domande come fai normalmente. Puoi aprirlo e leggerlo, se vuoi, ma nulla di tutto questo dipende dal fatto che tu lo faccia.
È un libro cartaceo?+
No, è digitale. Lo scarichi nel momento in cui l’ordine va a buon fine ed è tuo per sempre. La copertina è realizzata nello stile di un libro perché ogni edizione è scritta e curata come un’opera autonoma e completa. La parte della lettura spetta alla tua AI, non a te.
Pronto a specializzare la tua AI?
Un unico file pronto da usare. Paga una volta, usalo per sempre - funziona con Claude e ChatGPT.
Altro da questo scaffale
Anselma - Skill AI di direttrice dell'AI
Anselma - Skill AI di direttrice dell'AI
Hektor - Skill AI di ingegnere dell'affidabilità e della sicurezza dell'AI
Hektor - Skill AI di ingegnere dell'affidabilità e della sicurezza dell'AI
Fabrizio - Skill AI di ingegnere AI operativo sul campo
Fabrizio - Skill AI di ingegnere AI operativo sul campo
Odalric - Skill AI di ingegnere di ricerca sull'AI
Odalric - Skill AI di ingegnere di ricerca sull'AI