Ingrid - LLM評価エンジニア AI Skill
Complete skill package instant downloadIngrid-LLM評価エンジニアのスキル
Choose how to get it
Start All-Access, from $8.25/mo$99 a year, or $19 a month. 14-day refund on the first charge.
// all-access
You do not download skills. Your AI fetches them.
The KissMySkills connector is a small server your AI chat talks to. Add it once to Claude, ChatGPT, Claude Code or Cursor. From then on, any of our 1,000+ skills is one sentence away.
- 01Add the connector. Settings, Connectors, paste one link. A minute.
- 02Sign in once. The email from your subscription. Nothing installs.
- 03Ask for a skill. "Load Ingrid." It arrives in the conversation and your AI answers as that specialist.
Every skill, prompt pack and agent, new releases included. Single files can still be bought and kept. Cancel any time from your account. Compare plans
Secure checkout by Shopify
Add it once. Your AI works like a specialist.
Claude、ChatGPT、またはGeminiに追加すれば、あなたのAIがこの分野のスペシャリストとして機能します。
即時ダウンロード · 30日間返金保証。 一度支払えば、ずっと使える - サブスクリプション不要。私たちが執筆・テストしたもので、GitHubから無断収集したものではありません。 返金ポリシー
Ask Ingrid something hard.
Trademarks of their respective owners. KissMySkills is not affiliated with or endorsed by them.
あなたが読むのではありません。AIが読みます。
スキルファイルをClaude、ChatGPT、またはGeminiに一度追加するだけで、それ以降はこの分野の専門家として機能し、次のメッセージからIngridとして回答します。
一度購入すれば、そのファイルは永久にあなたのものです。またはAll-Accessに登録して、KissMySkillsコネクターに頼めば、そのファイルやほかのすべてのスキルをチャットに読み込めます。
// what's inside
このスキルの中身は何ですか
- ゴールデンデータセット:カバレッジ、エッジケース、リーケージなし
- LLM-as-judge:評価基準、バイアス軽減、人的キャリブレーション
- RAGとagentの指標(忠実性、ツール呼び出しの正確性)
- 信頼区間と有意性を用いたCI回帰ゲート
promptとモデルの変更を盲目的にリリースしており、リリース前に実効性のある評価ゲートを必要としているチーム。
シニアLLM評価エンジニアの報酬は時給130ドル以上。完全なスキルを永遠にあなたのものにできます。
What you're actually buying
IngridをClaudeに入れるだけで、シンプルなルール「評価ゲートなしでは出荷しない」を掲げるシニアLLM評価エンジニアが得られます。
IngridはLLMアプリとagentを評価します:ゴールデンデータセットの構築(カバレッジ、エッジケース、データ漏洩なし、バージョン管理)、指標の選定、LLM-as-judge(評価基準の設計、ペアワイズ評価とポイントワイズ評価、軽減策を含むバイアスと位置効果、人間のラベルに対するキャリブレーション)、RAG指標(忠実性、コンテキストと回答の関連性)、agentの軌跡評価(ツール呼び出しの正確性、タスク完了度)、オフラインハーネスとCI回帰ゲート、オンライン評価(A/Bテスト、ガードレール指標、人によるレビューのサンプリング)、統計的厳密性(信頼区間、有意性)を扱います。Ragas、promptfoo、DeepEval、LangSmith、Braintrustなどのツールを、ロックインなしで利用できます。リリース前には必ずホールドアウトセットで評価してください。
得られるもの
- →ゴールデンデータセット:カバレッジ、エッジケース、データ漏洩なし
- →LLM-as-judge:評価基準、バイアス軽減、人間によるキャリブレーション
- →RAGとagentの指標(忠実性、ツール呼び出しの正確性)
- →信頼区間と有意性を用いたCI回帰ゲート
インストール方法
.skillパッケージをダウンロード → Claudeを開く → SKILL.mdをProject Instructionsまたはシステムプロンプトに貼り付ける → 要件を説明する → Ingridが回答を作成します。何が得られるかを正確に確認できる、完全な実例も含まれています。
# Ingrid - LLM評価エンジニア あなたはIngrid、シニアLLM評価エンジニアです。あなたのルール:評価ゲートなしでリリースしない。 ## 仕事の進め方 1. ゴールデンセットを構築する(カバレッジ、エッジケース、データリークなし) 2. 指標を選定し、LLM-as-a-judgeの評価基準を設計して、人間の評価に合わせて調整する 3. オフラインで実行し、信頼区間付きで数値を報告する 4. リグレッションを検知したらCIをゲートし、A/Bテストとサンプリングでオンライン環境でも確認する 本番環境にリリースする前に、必ず開発環境またはステージング環境のホールドアウトセットで評価してください。
ダウンロードする実際のファイルのサンプル。
4つのステップ。どんなAIチャットでも。
- 01ファイルをダウンロード
チェックアウト後、ダウンロードリンクが受信トレイに届きます。ファイルはデバイス上の任意の場所に保存してください。
- 02AIチャットを開く
Claude、ChatGPT、Gemini、Grok、またはCopilot - すでに使っているものならどれでも。
- 03ファイルの内容を貼り付けてください
システムプロンプト、プロジェクトの指示、またはカスタム指示欄に貼り付けてください。
- 04作業を開始する
あなたのAIは専門家として設定されました。その専門分野についてなら、何でも質問できます。
技術的な知識は必要ありません。サブスクリプション不要。一度支払えば、ずっと使えます。
主要なAIチャットすべてに対応】【。
ファイルをAIのシステムprompt、プロジェクトの指示、またはカスタム指示に入れるだけ。セットアップ不要。コード不要。ベンダーロックインなし。
この製品についての質問
Ingrid skillは何をしますか?+
LLMアプリを評価します。golden set、LLM-as-judge、RAGとagentのメトリクス、回帰をブロックするCIゲートに対応しています。Claude Projectsに一度読み込ませるだけで、セッション開始時に毎回コンテキストを説明し直さなくても、設定済みのLLM Evaluation Engineerが使えるようになります。開発環境またはステージング環境で、ホールドアウトしたテストセットに対して構築・評価し、ガードレール、コストとレート制限、人によるレビューを追加してから、本番でagentやLLM機能を提供する前に、評価とモニタリングの下で段階的に展開できます。
このskillファイルはどうやってインストールしますか?+
.skillパッケージ(SKILL.mdを含む)をダウンロードし、内容をClaude Projects Instructionsまたはお使いのAIのシステムプロンプトに貼り付けて、自分のコンテキストを追加し、最初のセッションを始めてください。Claude、ChatGPT、またはシステムプロンプトを受け付けるあらゆるAIチャットで使えます。
このskillはどのAIツールで使えますか?+
Claude(推奨)、ChatGPT、Gemini、Perplexity、Copilot、およびシステムプロンプトを受け付けるあらゆるAIチャットで使えます。最良の結果が得られるのはClaude Projectsです。
このダウンロードには何が含まれていますか?+
購入後すぐに受け取れる1つの.skillパッケージです。完全なSKILL.mdの役割設定に加え、実際のシナリオを使った実例ファイルが含まれているため、頼る前に品質を確認できます。サブスクリプションは不要で、永久にあなたのものです。
Ingrid skillを使わずにClaudeを使う場合と何が違いますか?+
skillファイルがなければ、AIは毎回のセッションで汎用アシスタントとして開始します。Ingridを読み込むと、最初のメッセージからLLM Evaluation Engineerの方法論を適用し、毎回一貫した品質で対応します。開発環境またはステージング環境で、ホールドアウトしたテストセットに対して構築・評価し、ガードレール、コストとレート制限、人によるレビューを追加してから、本番でagentやLLM機能を提供する前に、評価とモニタリングの下で段階的に展開できます。
自分で読む必要はありますか?+
いいえ。このファイルはあなたではなく、AIが読むために書かれています。一度アップロードまたは貼り付ければ、AIがその役割を引き受けます。その後は、普段どおりに質問するだけです。開いて読んでいただいても構いませんが、あなたが読むことを前提とした内容ではありません。
これは紙の本ですか?+
いいえ、デジタル版です。注文が完了した瞬間にダウンロードでき、永久にあなたのものになります。各エディションは1つの自己完結した作品として執筆・編集されているため、表紙は本のようなデザインになっています。読むのはあなたではなく、AIの役目です。
AIを専門分野に特化させる準備はできましたか?
そのまま導入できる1つのファイル。1回支払えば、永久に使えます - ClaudeとChatGPTに対応。