This skill as a file
$7 one payment, yours forever
- Download right after checkout, keep it for good
- Paste it into ChatGPT, Claude, Gemini or any AI chat, free plans included
- 30-day money-back guarantee
Lanza un reconocimiento de voz que funcione: ajusta el ASR a tu dominio, mide el WER por acento y condición, y respeta el presupuesto de latencia.
Paquete skill completo descarga instantáneahabilidad de ingeniero de aprendizaje automático para audio y voz de Xiulan
Este y 2,500+ más, dentro de tu IA
AI CRM includedPaga una vez, tuyo para siempreDescarga instantáneaGarantía de reembolso de 30 días
As featured onProduct HuntFazierKittyLaunch
Secure checkout by Shopify
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
Ask Xiulan something hard.
O todos los skills, dentro de tu IA.
¿Dudas antes de comprar? Responde una persona, normalmente el mismo día: hello@kissmyskills.com
// the file itself
The first lines of the file your AI will read, exactly as delivered. Nothing rewritten for the page.
Eres Xiulan, una ingeniera sénior de ML especializada en voz y audio que crea un conjunto de evaluación estratificado antes de tocar Whisper y reporta la WER por subgrupo. Has sido activada para convertir audio en una transcripción que una empresa pueda utilizar.
// what's inside
Equipos que desarrollan productos de voz o audio de llamadas cuya transcripción falla con los acentos y el ruido de sus usuarios reales.
// two ways to get it
$7 one payment, yours forever
$9/mo cancel anytime, or $59 a year
Subscribers can still buy single files and keep them after they cancel.
// ask your assistant
Go to kissmyskills.com/pages/for-ai-agents and set up the "Xiulan - Skill de AI de ingeniero de reconocimiento de voz" skill (handle: xiulan-speech-audio-ml-engineer) for me
Paste it into Claude, ChatGPT, Claude Code, Cursor or Codex. Your AI walks you through connecting KissMySkills (about 3 minutes, 7-day free trial) and loads the skill. What your AI will read →
Integra Xiulan en Claude y obtén un ingeniero de voz que informa la tasa de error de palabras por acento y condición, porque un único WER general oculta precisamente a los usuarios a los que estás fallando.
Xiulan se encarga de toda la modalidad de audio de principio a fin: reconocimiento automático del habla con Whisper y sus sucesores, decodificación en streaming frente a por lotes, medición de WER y lo que oculta, adaptación al dominio, vocabulario personalizado y sesgo contextual; diarización e identificación de hablantes; detección de actividad de voz; texto a voz y clonación de voz bajo restricciones de consentimiento; preprocesamiento de audio, incluido el remuestreo, la reducción de ruido, la cancelación de eco y la separación de canales; detección de palabras clave y palabras de activación; clasificación de audio y detección de eventos; pipelines de streaming en tiempo real con presupuestos de latencia; y el problema de equidad que surge cuando la calidad del reconocimiento varía considerablemente según el acento y el dialecto.
Lo que obtienes
Cómo instalar
Descarga el paquete .skill → abre Claude → pega SKILL.md en las instrucciones de tu proyecto o en el prompt del sistema → describe tus requisitos → Xiulan crea la respuesta. Incluye un ejemplo completo paso a paso para que veas exactamente qué obtienes.
Después del pago, el enlace de descarga llegará a tu bandeja de entrada. Guarda el archivo en cualquier lugar de tu dispositivo.
Claude, ChatGPT, Gemini, Grok o Copilot: el que ya uses.
Introdúcelo en el prompt del sistema, en las instrucciones del proyecto o en el campo de instrucciones personalizadas.
Tu AI ahora está configurada como especialista. Pregúntale cualquier cosa dentro de su ámbito.
No se requieren conocimientos técnicos.
Con Unlimited no hay nada que descargar. Conecta tu IA una vez y pide: «Carga a Xiulan de KissMySkills».
Guía de configuración → Unlimited · $4.92/mes en el plan anual →
Crea sistemas de voz que funcionan: ajusta el ASR a tu dominio, mide el WER por acento y condición, y respeta el presupuesto de latencia. Cárgala una vez en Claude Projects y obtendrás un Speech & Audio ML Engineer configurado, sin tener que volver a explicar el contexto al inicio de cada sesión. Comprueba cada cifra con una fuente confiable y un conjunto de validación honesto antes de que alguien tome una decisión basándose en ella, y expresa la incertidumbre en lugar de presentar una única estimación puntual con confianza excesiva.
Descarga el paquete .skill (contiene SKILL.md), pega el contenido en las instrucciones de Claude Projects o en el prompt del sistema de tu AI, añade tu propio contexto e inicia tu primera sesión. Funciona con Claude, ChatGPT o cualquier chat de AI que acepte prompts del sistema.
Funciona con Claude (recomendado), ChatGPT, Gemini, Perplexity y Copilot, así como con cualquier chat de AI que acepte prompts del sistema. Claude Projects ofrece los mejores resultados.
Un paquete .skill que se entrega al instante después de la compra: la configuración completa del rol en SKILL.md, además de un archivo con un ejemplo práctico y un caso real para que compruebes la calidad antes de confiar en ella. Sin suscripción, es tuyo para siempre.