<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0">
  <channel>
    <title><![CDATA[Daniel Wrigley - Elasticsearch Labs]]></title>
    <description><![CDATA[Articles and tutorials from the Search team at Elastic]]></description>
    <copyright><![CDATA[© 2026. Elasticsearch B.V. All Rights Reserved]]></copyright>
    <image>
      <title><![CDATA[Daniel Wrigley - Elasticsearch Labs]]></title>
      <url>https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt1121c0bf0e8a6e65/6a88da6340a1841030ef456f/search-labs-thumbnail.png</url>
      <link>https://www.elastic.co/jp/search-labs/author/daniel-wrigley</link>
    </image>
    <link>https://www.elastic.co/jp/search-labs/author/daniel-wrigley</link>
    <atom:link href="https://www.elastic.co/jp/search-labs/rss/author/daniel-wrigley.xml" rel="self" type="application/rss+xml"/>
    <language><![CDATA[jp]]></language>
    <lastBuildDate>Tue, 29 Sep 2026 07:57:30 GMT</lastBuildDate>
  <item>
    <title><![CDATA[Quepidでジャッジメントリストを作成する]]></title>
    <description><![CDATA[Quepidで人間の評価者が協力して判定リストを作成する方法、ベンチマークを使用して関連性を調整する方法を学びます。]]></description>
    <content:encoded><![CDATA[<p><a href="https://www.elastic.co/search-labs/blog/judgment-lists">判断リスト</a>の作成は、検索結果の品質を最適化する上で重要なステップですが、複雑で困難な作業になる場合があります。判断リストは、対応する結果の関連性評価と組み合わせた検索クエリの厳選されたセットであり、テスト コレクションとも呼ばれます。このリストを使用して計算されたメトリックは、検索エンジンのパフォーマンスを測定するためのベンチマークとして機能します。判断リストの作成プロセスを効率化するために、 <a href="https://opensourceconnections.com/">OpenSource Connections</a>チームは<a href="https://quepidapp.com/">Quepid を</a>開発しました。判断は明示的なものでも、ユーザーからの暗黙的なフィードバックに基づくものでも構いません。このブログでは、あらゆる判断リストの基礎となる明示的な判断を人間の評価者が効果的に行えるように、Quepid で共同作業環境を設定する方法について説明します。</p><p>Quepid は、検索品質評価プロセスにおいて検索チームをサポートします。</p><ul><li><p>クエリセットを構築する</p></li><li><p>判断リストを作成する</p></li><li><p>検索品質指標を計算する</p></li><li><p>計算された検索品質指標に基づいて、さまざまな検索アルゴリズム/ランカーを比較します</p></li></ul><p>私たちのブログでは、映画レンタル店を運営しており、検索結果の品質を向上させることを目標としていると仮定しましょう。</p><h2>要件</h2><p>このブログでは<a href="https://github.com/o19s/es-tmdb">、es-tmdb リポジトリ</a>のデータとマッピングを使用します。データは<a href="https://www.themoviedb.org/">The Movie Database</a>から取得されています。手順に沿って、マッピングを使用して tmdb というインデックスを設定し、データにインデックスを付けます。ローカルインスタンスをセットアップするか、Elastic Cloud デプロイメントを使用するかは問題ではありません。どちらでも問題なく動作します。このブログでは、Elastic Cloud のデプロイメントを想定しています。データのインデックス作成方法については<a href="https://github.com/o19s/es-tmdb/blob/master/README.md">、es-tmdb リポジトリの README を</a>参照してください。</p><p>検索するデータがあることを確認するには、 <code>rocky</code>のタイトル フィールドで単純な一致クエリを実行します。</p>GET tmdb/_search
{
 "query": {
   "match": {
     "title": "rocky"
   }
 }
}<p>8 件の結果が表示されます。</p>{
 "took": 2,
 "timed_out": false,
 "_shards": {
   "total": 1,
   "successful": 1,
   "skipped": 0,
   "failed": 0
 },
 "hits": {
   "total": {
     "value": 8,
     "relation": "eq"
   }
…
}<h2>Quepidにログイン</h2><p><a href="https://github.com/o19s/quepid">Quepid は</a>、ユーザーが検索結果の品質を測定し、オフライン実験を実行して品質を向上できるようにするツールです。</p><p>Quepid は 2 つの方法で使用できます: <a href="https://app.quepid.com">https://app.quepid.com</a>で公開されている無料のホストバージョンを使用するか、または、アクセスできるマシンに Quepid をセットアップします。この投稿では、無料のホスト バージョンを使用していることを前提としています。ご使用の環境に Quepid インスタンスを設定する場合は、<a href="https://github.com/o19s/quepid/wiki/Installation-Guide">インストール ガイド</a>に従ってください。</p><p>どちらの設定を選択する場合でも、まだアカウントをお持ちでない場合はアカウントを作成する必要があります。</p><h2>Quepidケースの設定方法</h2><p>Quepid は「ケース」を中心に構成されています。ケースには、関連性調整設定と検索エンジンへの接続を確立する方法とともにクエリが保存されます。</p><ul><li><p>初めて使用する場合は、 <strong>「最初の関連性ケースを作成する」</strong>を選択します。</p></li><li><p>再度アクセスしたユーザーは、トップレベルのメニューから<strong>[関連性ケース]</strong>を選択し、 <strong>[+ ケースを作成] を</strong>クリックできます。</p></li></ul><p>ベースライン検索の測定と改善を開始するため、ケースに説明的な名前を付けます (例:「映画検索ベースライン」)。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blte2913d344c42cd24/6a17e6477b54f906b48b38bd/8f9e480d9aae0d706cfc5371e41f19c706dd452a-594x251.png" alt="Quepidケースの設定" /><p><strong>[続行]</strong>を選択して名前を確認します。</p><p>次に、Quepid から検索エンジンへの接続を確立します。Quepid は、Elasticsearch を含むさまざまな検索エンジンに接続できます。</p><p>構成は、Elasticsearch と Quepid の設定によって異なります。Quepid を Elastic Cloud デプロイメントに接続するには、Elastic Cloud デプロイメントに対して CORS を有効にして構成し、API キーを用意する必要があります。詳細な手順は、 <a href="https://quepid-docs.dev.o19s.com/2/quepid/49/how-to-connect-quepid-to-elastic-cloud">Quepid ドキュメントの対応するハウツー</a>に記載されています。</p><p>Elasticsearch エンドポイント情報 ( <code>https://YOUR_ES_HOST:PORT/tmdb/_search</code> ) と接続に必要な追加情報 (<strong>詳細</strong>設定オプションの Elastic Cloud デプロイメントの場合は API キー) を入力し、 <strong>ping</strong>をクリックして接続をテストし、 <strong>[続行</strong>] を選択して次のステップに進みます。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltcc068309bdc094ae/6a17e6480b0bed14cddd356a/267339dfaecae2740eb2ee2739bdc971608bdb5f-588x1169.png" alt="QuepidでElasticsearchエンドポイントを設定します。" /><p>ここで、ケースに表示するフィールドを定義します。人間の評価者が後で特定のクエリに対するドキュメントの関連性を評価するのに役立つものをすべて選択します。</p><p><code>title</code><em>タイトル フィールド</em>として設定し、 <code>_id</code> <em>ID フィールド</em>のままにして、 <code>overview, tagline, cast, vote_average, thumb:poster_path</code><em>追加表示フィールド</em>として追加します。最後のエントリには、結果内の映画の小さなサムネイル画像が表示され、私たちと人間の評価者に視覚的にガイドします。</p><p><strong>[続行]</strong>ボタンを選択して表示設定を確認します。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltc910bdf5aa7680b3/6a17e64ae8fbce710b3a1906/02c58aae8c2ebb6d31f538b27462b4c65428fdc3-594x493.png" alt="Quepidの人間評価者向けに、ケースで表示するフィールドを定義します。" /><p>最後のステップは、ケースに検索クエリを追加することです。入力フィールドから<em>「スターウォーズ」</em> 、 <em>「ハリソンフォード」</em> 、 <em>「ベストアクション映画」の</em>3 つのクエリを 1 つずつ追加し、 <strong>「続行」をクリックします</strong>。</p><p>理想的には、ケースには実際のユーザークエリを表し、さまざまな種類のクエリを示すクエリが含まれます。現時点では、<em>スターウォーズは</em>映画のタイトルのすべてのクエリを表すクエリ、<em>ハリソンフォードは</em>キャストメンバーのすべてのクエリを表すクエリ、<em>ベストアクション映画は</em>特定のジャンルの映画を検索するすべてのクエリを表すクエリであると想像できます。これは通常、クエリ セットと呼ばれます。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt46122bb45e1063e4/6a17e64b505ac36510ad8af8/baccfe96766319aa7255e9bff08913ac87d1517f-595x326.png" alt="Quepidケースに検索クエリを追加する" /><p>実稼働シナリオでは、<a href="https://opensourceconnections.com/blog/2022/10/13/how-to-succeed-with-explicit-relevance-evaluation-using-probability-proportional-to-size-sampling/">確率比例サイズサンプリング</a>などの統計手法を適用してイベント トラッキング データからクエリをサンプリングし、これらのサンプリングされたクエリを Quepid にインポートして、頻度に応じて先頭 (頻繁に発生するクエリ) と末尾 (発生頻度の低いクエリ) のクエリを含めます。つまり、まれなクエリを除外することなく、より頻度の高いクエリに偏向させるということです。</p><p>最後に、 <strong>「完了」</strong>を選択すると、定義された 3 つのクエリが表示されるケース インターフェイスに移動します。</p><h2>クエリと情報ニーズ</h2><p>判断リストという全体的な目標に到達するには、人間の評価者が特定のクエリに対する検索結果 (通常はドキュメント) を判断する必要があります。これはクエリ/ドキュメント ペアと呼ばれます。</p><p>場合によっては、クエリを見るとユーザーが何を望んでいたかが簡単にわかるようです。クエリ<code>harrison ford</code>の目的は、俳優のハリソン・フォードが主演する映画を見つけることです。クエリ<code>action</code>についてはどうでしょうか?ユーザーの意図はアクション ジャンルに属する映画を見つけることだと言いたくなるでしょう。でもどれですか？最新のもの、最も人気のあるもの、ユーザーの評価による最高のものはありますか?あるいは、ユーザーは「アクション」と呼ばれるすべての映画を見つけたいのでしょうか?<a href="https://www.themoviedb.org/search/movie?query=Action">映画データベースには「アクション」というタイトルの映画が少なくとも 12 本 (!) あり</a>、それらの名前は主にタイトルに含まれる感嘆符の数によって異なります。</p><p>意図が不明瞭なクエリの場合、2 人の評価者の間で解釈に違いが生じる可能性があります。情報ニーズの登場:<a href="https://en.wikipedia.org/wiki/Information_needs">情報ニーズ</a>とは、情報に対する意識的または無意識的な欲求のことです。情報ニーズを定義すると、人間の評価者がクエリに対して文書を判断するのに役立つため、判断リストを構築するプロセスで重要な役割を果たします。専門ユーザーまたは主題の専門家は、情報ニーズを指定するのに適しています。検索結果はユーザーのニーズを満たす必要があるため、ユーザーの視点から情報ニーズを定義することをお勧めします。</p><p>「映画検索ベースライン」のケースのクエリに必要な情報:</p><ol><li><p><strong>スターウォーズ</strong>: ユーザーはスターウォーズシリーズの映画や番組を見つけたいと考えています。関連性がある可能性があるのは、スターウォーズに関するドキュメンタリーです。</p></li><li><p><strong>ハリソン・フォード</strong>: ユーザーは俳優ハリソン・フォードが主演する映画を見つけたいと考えています。関連性がある可能性があるのは、ハリソン・フォードがナレーターなどの別の役割を担っている映画です。</p></li><li><p><strong>最高のアクション映画</strong>: ユーザーはアクション映画、できれば平均ユーザー投票数の多い映画を見つけたいと考えています。</p></li></ol><h2>Quepidで情報ニーズを定義する方法</h2><p>Quepid で情報ニーズを定義するには、ケース インターフェースにアクセスします。</p><p>1. クエリ (たとえば、<em>スターウォーズ</em>) を開き、 <em>[Toggle Notes] を選択します。</em></p><p>2. 最初のフィールドに情報ニーズを入力し、2 番目のフィールドに追加のメモを入力します。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blte57395f64f6e5fab/6a17e64d6864a40fd6b68771/e01d3d5242a350d8797faa665eb3170039f5dfa2-1483x559.png" alt="Quepidで情報とクエリのニーズを定義します。" /><p>3. <strong>「保存」</strong>をクリックします。</p><p>少数のクエリの場合、このプロセスは適切です。ただし、ケースを 3 クエリから 100 クエリに拡張する場合 (Quepid のケースでは、多くの場合、クエリは 50 ～ 100 クエリの範囲です)、Quepid の外部で (たとえば、スプレッドシートで) 情報ニーズを定義し、それを<strong>[インポート</strong>] からアップロードして<strong>[情報ニーズ] を選択する必要がある</strong>場合があります。</p><h2>Quepidでチームを作成し、ケースを共有する</h2><p>共同判断により関連性評価の品質が向上します。チームを設定するには:</p><p>1. 最上位メニューの<strong>「Teams」</strong>に移動します。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt45c51d1a0e05a80d/6a17e64fe8fbcede793a190f/797706e8d130b474a95d30b6fa22ecaf36f98c03-613x58.png" alt="Quepidでチームを作成します。" /><p>2. <strong>[+ 新規追加]</strong>をクリックし、チーム名 (例:「検索関連性評価者」) を入力して、 <strong>[作成] を</strong>クリックします。</p><p>3. メールアドレスを入力し、 <strong>「ユーザーの追加」</strong>をクリックしてメンバーを追加します。</p><p>4. ケースインターフェースで、 <strong>「ケースの共有」</strong>を選択します。</p><p>5. 適切なチームを選択して確認します。</p><h2>Quepidで判定ブックを作成する</h2><p>Quepid のブックでは、複数の評価者がクエリ/ドキュメントのペアを体系的に評価できます。作成するには:</p><p>1. ケースインターフェースの<strong>「判決」</strong>に移動し、 <strong>「+ ブックを作成」</strong>をクリックします。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt3543c00e0b834b3f/6a17e650e9ea87f57fa9c598/6a077f26225961150b7414463d7db04f090b68d6-896x365.png" alt="Quepidで判定ブックを作成します。" /><p>2. ブックにわかりやすい名前を付けてチームに割り当て、採点方法 (DCG@10 など) を選択し、選択戦略 (単一または複数の評価者) を設定します。ブックには次の設定を使用します。</p><ul><li><p><strong>名称</strong>：「映画検索0-3スケール」</p></li><li><p><strong>この本を共有するチーム</strong>: 作成したチームのボックスにチェックを入れます</p></li><li><p><strong>得点者</strong>: DCG@10</p></li></ul><p>3. <strong>「ブックを作成」をクリックします。</strong></p><p>名前は説明的で、検索対象（「映画」）に関する情報と、評価のスケール（「0～3」）が含まれています。選択したスコアラー DCG@10 によって、検索メトリックの計算方法が決まります。「DCG」は<a href="https://en.wikipedia.org/wiki/Discounted_cumulative_gain">「Discounted Cumulative Gain」</a>の略で、「@10」は指標を計算する際に考慮される上位からの結果の数です。</p><p>この場合、情報ゲインを測定し、それを位置の重み付けと組み合わせるメトリックを使用しています。他にもユースケースに適した検索メトリックが存在する可能性があり、<a href="https://opensourceconnections.com/blog/2020/02/28/choosing-your-search-relevance-metric">適切なものを選択すること自体が課題となります</a>。</p><h2>クエリとドキュメントのペアをブックに入力する</h2><p>関連性評価のためにクエリ/ドキュメントのペアを追加するには、次の手順に従います。</p><p>1.ケース インターフェースで、「判決」に移動します。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt0e98583138535cc3/6a17e6520b0bed4f51dd3571/d717c5b06ae6cb42ed2b9e771486a12f738a9890-1041x218.png" alt="Quepidでクエリとドキュメントのペアをブックに入力します。" /><p>2. 作成したブックを選択します。</p><p>3. 「ブックに入力」をクリックし、「ブックのクエリ/ドキュメント ペアを更新」を選択して確認します。</p><p>このアクションにより、各クエリの上位の検索結果に基づいてペアが生成され、チームによる評価の準備が整います。</p><h2>人間の評価チームに判断させる </h2><p>これまでに完了した手順は、かなり技術的かつ管理的なものでした。必要な準備が完了したので、審査員チームに作業を任せることができます。本質的に、審査員の仕事は、与えられたクエリに対する特定の文書の関連性を評価することです。このプロセスの結果は、判断されたクエリ ドキュメント ペアのすべての関連性ラベルを含む判断リストです。次に、このプロセスとそのインターフェースについてさらに詳しく説明します。</p><h3>人間評価インターフェースの概要</h3><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt553afb07d8080421/6a17e654505ac30514ad8afc/be3016091b49655dab3354d84e6dc638f3468390-1283x664.png" alt="Quepidの人間評価インターフェースが文書やクエリにある情報を判断する方法。" /><p>Quepidの人間評価インターフェースは、効率的な評価ができるように設計されています。</p><ul><li><p><strong>クエリ:</strong>検索用語を表示します。</p></li><li><p><strong>情報ニーズ:</strong>ユーザーの意図を示します。</p></li><li><p><strong>採点ガイドライン:</strong>一貫した評価を行うための指示を提供します。</p></li><li><p><strong>ドキュメント メタデータ:</strong>ドキュメントに関する関連詳細を表示します。</p></li><li><p><strong>評価ボタン:</strong>評価者は対応するキーボード ショートカットを使用して判断を割り当てることができます。</p></li></ul><h3>人間評価インターフェースを使用する</h3><p>人間の評価者として、私は本の概要からインターフェースにアクセスします。</p><p>1. ケース インターフェイスに移動し、 <strong>[判決]</strong>をクリックします。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt0e98583138535cc3/6a17e6520b0bed4f51dd3571/d717c5b06ae6cb42ed2b9e771486a12f738a9890-1041x218.png" alt="Quepid人間評価インターフェースを使用する " /><p>2. <strong>「より多くの判断が必要です!」</strong>をクリックします。</p><p>システムはまだ評価されておらず、追加の判断が必要なクエリ/ドキュメントのペアを提示します。これは、ブックの選択戦略によって決まります。</p><ul><li><p><em>単一の評価者</em>: クエリ/ドキュメントのペアごとに 1 つの判断。</p></li><li><p><em>複数の評価者</em>: クエリ/ドキュメントのペアごとに最大 3 つの判断。</p></li></ul><h3>クエリとドキュメントのペアを評価する</h3><p>いくつかの例を見てみましょう。このガイドに従うと、さまざまな映画が表示される可能性が高くなります。ただし、評価の原則は変わりません。</p><p>最初の例は、映画「Heroes」でクエリ<em>「harrison ford」</em>を検索するものです。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blta248e787b5e0a670/6a17e656ec0f89612d5a65ee/c1e14b0d8b04dd579471932dbe4ff72ae5692a02-981x571.png" alt="Quepidでブックにクエリとドキュメントペアを入力する方法" /><p>まずクエリを確認し、次に情報ニーズを確認し、最後に指定されたメタデータに基づいて映画を判断します。</p><p>この映画は、ハリドソン・フォードが出演しているため、私たちの検索に関連する結果です。私たちは主観的には最近の映画の方が関連性が高いと考えるかもしれませんが、これは私たちの情報ニーズには含まれません。したがって、この文書は当社の評価尺度で 3 に相当する「完璧」と評価されます。</p><p>次の例は、映画「フォードvsフェラーリ」のクエリ<em>「harrison ford」</em>です。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltf5d86aac918a1e96/6a17e657414c64833e945152/052af7894506d7a765af156ba8e26ceec3559973-981x789.png" alt="Quepidのクエリ「harrison ford」に対する映画「フォード対フェラーリ」の例。" /><p>同じ慣例に従い、クエリ、情報ニーズ、そしてドキュメントのメタデータが情報ニーズにどの程度一致しているかを見て、このクエリ/ドキュメントを判断します。</p><p>これは悪い結果です。この結果は、おそらく、クエリ用語の 1 つである「ford」がタイトルに一致していることを示していると思われます。しかし、ハリソン・フォードはこの映画でも他の役でも何の役も演じていない。したがって、この文書は「悪い」と評価され、これは当社の評価尺度では 0 に相当します。</p><p>3番目の例は、クエリ<em>「ベストアクション映画</em>」に対する映画「アクションジャクソン」です。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt2cee335ddd1e6a92/6a17e6596df731d1f40a0ed7/247ab862fbc7435537709f8c96619cb331133d09-985x606.png" alt="クエリ「best action movie」に対する「アクション・ジャクソン」の例。" /><p>これはアクション映画のように見えるので、情報ニーズは少なくとも部分的に満たされています。しかし、投票平均は10点満点中5.4点です。そのため、この映画はおそらく私たちのコレクションの中で最高のアクション映画ではないでしょう。したがって、審査員である私としては、この文書を「普通」と評価します。これは、当社の評価尺度では 1 です。</p><p>これらの例は、特に Quepid を使用してクエリ/ドキュメントのペアを評価するプロセスを、高レベルと全般にわたって示しています。</p><h2>人間評価者の最適な活用のヒント</h2><p>示された例を見ると、明確な判断に至るのは簡単そうに思えるかもしれません。しかし、信頼できる人間による評価プログラムを構築するのは簡単なことではありません。これは、データの品質を簡単に損なう可能性のある課題に満ちたプロセスです。</p><ul><li><p>人間の評価者は反復的な作業で疲れてしまうことがあります。</p></li><li><p>個人的な好みにより判断が歪む可能性があります。</p></li><li><p>分野の専門知識のレベルは裁判官によって異なります。</p></li><li><p>評価者は多くの場合、複数の責任を同時にこなします。</p></li><li><p>ドキュメントの認識された関連性は、クエリに対する実際の関連性と一致しない場合があります。</p></li></ul><p>これらの要因により、一貫性のない低品質の判断が生じる可能性があります。しかし、心配する必要はありません。これらの問題を最小限に抑え、より堅牢で信頼性の高い評価プロセスを構築するのに役立つ、実証済みのベスト プラクティスがあります。</p><ul><li><p><strong>一貫した評価:</strong>クエリ、情報ニーズ、ドキュメント メタデータを順番に確認します。</p></li><li><p><strong>ガイドラインを参照してください:</strong>一貫性を保つためにスコアリング ガイドラインを使用します。採点ガイドラインには、どのグレードをいつ適用するかの例など、審査プロセスを示すものが含まれます。最初の一連の判断の後に人間の評価者とチェックインすることは、困難なエッジケースや追加のサポートが必要な場所を知るための良い方法であることが証明されました。</p></li><li><p><strong>オプションを活用する:</strong>不明な場合は、「後で判断します」または「わかりません」を使用し、必要に応じて説明を加えます。</p></li><li><p><strong>休憩を取る:</strong>定期的に休憩を取ると判断力を維持するのに役立ちます。Quepid は、人間の評価者が一連の判定を終えるたびに紙吹雪を飛ばして、定期的な休憩を促します。</p></li></ul><p>これらの手順に従うことで、Quepid で判断リストを作成するための構造化された共同アプローチを確立し、検索関連性の最適化の取り組みの有効性を高めることができます。</p><h2>今後の見通し</h2><p>ここからどこへ行くのでしょうか?判断リストは、検索結果の品質を向上させるための基本的なステップの 1 つにすぎません。次の手順は次のとおりです。</p><h3>指標を計算して実験を始める</h3><p>判断リストが利用可能になると、その判断を活用して<a href="https://opensourceconnections.com/blog/2020/02/28/choosing-your-search-relevance-metric/">検索品質メトリック</a>を計算するのは自然な流れになります。Quepid は、判断が可能な場合、現在のケースに対して構成されたメトリックを自動的に計算します。メトリックは「スコアラー」として実装されており、サポートされているメトリックにお気に入りのメトリックが含まれていない場合は、独自のメトリックを提供できます。</p><p>ケース インターフェイスに移動し、 <strong>[スコアラーの選択]</strong>に移動して、 <em>DCG@10</em>を選択し、 <strong>[スコアラーの選択]</strong>をクリックして確認します。Quepid はクエリごとに DCG@10 を計算し、全体的なクエリの平均も計算して、ケースの検索結果の品質を定量化します。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt0d059c959b842139/6a17e65be8fbceb29b3a1913/0ff3b9918342071744d681a43d542102e927abd3-1163x551.png" alt="Quepidで検索結果の品質を定量化する方法。 " /><p>検索結果の品質が定量化されたので、最初の実験を実行できます。実験は仮説を立てることから始まります。評価を行った後のスクリーンショットの 3 つのクエリを見ると、検索品質メトリックの点から見ると 3 つのクエリのパフォーマンスが大きく異なることが明らかです。 <em>「スターウォーズ」</em>のパフォーマンスはかなり良好で、 <em>「ハリソンフォード」</em>も悪くありませんが、最も大きな可能性を秘めているのは<em>「ベストアクション映画」です</em>。</p><p>このクエリを拡張すると、その結果が表示され、細かい詳細まで掘り下げて、ドキュメントが一致した理由やスコアに影響を与えるものを調べることができます。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt35227761f4524a1e/6a17e65cb1e11325c579f25a/c45c6cae085a492198c0f8b7060a1a7204e3724e-1131x691.png" alt="さまざまなクエリを試して、Quepidのさまざまな検索指標でどのように機能するかを確認しています。" /><p>「クエリの説明」をクリックして「解析」タブに入ると、クエリが<em>キャスト</em>、<em>概要</em>、<em>タイトルの</em>3つのフィールドを検索するDisjunctionMaxxQueryであることがわかります。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt0966653b9ab3cc9c/6a17e65efaa913171f93c84c/4a1e1bb2a9cd28e9c48e0ba16357d17ed9d3a5cf-894x557.png" alt="クエリの解析を説明しています" /><p>通常、検索エンジニアとして私たちは、検索プラットフォームに関するドメイン固有の情報をある程度知っています。この場合、<em>ジャンル</em>フィールドがあることが分かります。これをクエリに追加して、検索品質が向上するかどうかを確認しましょう。</p><p><strong>ケース インターフェースで[関連性の調整]</strong> を選択すると開く<strong> クエリ サンドボックス</strong> を使用します。検索する<em>ジャンル</em>フィールドを追加して、これを探索してみましょう。</p>{
  "query": {
    "multi_match": {
      "query": "#$query##",
      "type": "best_fields",
      "fields": [
        "title^10",
        "overview",
        "cast",
        "genres"
      ]
    }
  }
}<p>「検索を再実行」をクリックしてください。そして結果を確認します。彼らは変わったのでしょうか？残念ながらそうではありません。現在、探索できるオプションは多数あり、基本的には Elasticsearch が提供するすべてのクエリ オプションがあります。</p><ul><li><p>ジャンルフィールドのフィールドウェイトを増やすことができます。</p></li><li><p>投票平均によってドキュメントをブーストする関数を追加できます。</p></li><li><p>ジャンルの一致が強い場合にのみ投票平均によってドキュメントをブーストする、より複雑なクエリを作成することもできます。</p></li><li><p>…</p></li></ul><p>これらすべてのオプションを Quepid で検討することの最大の利点は、改善しようとしている 1 つのクエリだけでなく、この場合のすべてのクエリへの影響を定量化できる点です。これにより、他のクエリの検索結果の品質を犠牲にして、パフォーマンスの低いクエリを改善することが防止されます。リスクなしで迅速かつ安価に反復して仮説の価値を検証できるため、オフライン実験はすべての検索チームの基本的な機能になります。</p><h3>評価者間の信頼性を測定する</h3><p>タスクの説明、情報のニーズ、そして Quepid が提供するような人間の評価者インターフェースがあっても、人間の評価者の間で意見の相違が生じる可能性があります。</p><p>意見の相違自体は悪いことではありません。むしろその逆です。意見の相違を測定することで、取り組むべき問題が明らかになることがあります。関連性は主観的である可能性があり、クエリはあいまいであり、データは不完全または不正確である可能性があります。<a href="https://en.wikipedia.org/wiki/Fleiss%27_kappa">Fleiss の Kappa</a>は評価者間の一致を測る統計的尺度であり、Quepid には使用できるサンプルノートブックがあります。これを見つけるには、最上位のナビゲーションで[ノートブック]を選択し、 例の<strong> フォルダーにあるノートブック Fleiss Kappa.ipynb</strong> を選択します。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt92d52b30f1fb19c1/6a17e660abe0f2224bdfe9bb/f0669ae96371368ef4d84bb28669560ef09d755c-624x61.png" alt="Quepidで、評価者間の一致度を測定するFleissのKappa統計指標のノートブックを見つける方法。" /><h2>まとめ</h2><p>Quepid は、最も複雑な検索関連性の課題にも対処できるようにし、進化し続けています。<a href="https://github.com/o19s/quepid/blob/main/CHANGELOG.md#800----2024-02-14">バージョン 8 では、Quepid は AI 生成の判断をサポートしており</a>、これは判断生成プロセスを拡大したいチームにとって特に便利です。</p><p>Quepid ワークフローを使用すると、スケーラブルな判断リストを効率的に作成できるため、最終的にはユーザーのニーズを真に満たす検索結果が得られます。判断リストを確立すると、検索の関連性を測定し、改善を繰り返し、ユーザー エクスペリエンスを向上させるための強固な基盤が得られます。</p><p>先に進む際には、関連性の調整は継続的なプロセスであることを忘れないでください。判断リストを使用すると進捗状況を体系的に評価できますが、実験、メトリック分析、反復的な改善と組み合わせると最も強力になります。</p><h2>参考資料</h2><ul><li><p>Quepid ドキュメント:</p><ul><li><p><a href="https://quepid-docs.dev.o19s.com/2/quepid/32/relevancy-is-a-team-sport">関連性はチームスポーツ</a></p></li><li><p><a href="https://quepid-docs.dev.o19s.com/2/quepid/18/quepid-for-human-raters">人間の評価者のためのQuepid</a></p></li><li><p><a href="https://quepid-docs.dev.o19s.com/2/quepid/49/how-to-connect-quepid-to-elastic-cloud">QuepidをElastic Cloudに接続する方法</a></p></li></ul></li><li><p><a href="https://github.com/o19s/quepid">Quepid Githubリポジトリ</a></p></li><li><p><a href="https://opensourceconnections.com/blog/2020/07/07/meet-pete-the-e-commerce-search-product-manager/">電子商取引の検索を改善するブログシリーズ「Pete」</a></p></li><li><p><a href="https://opensourceconnections.com/slack">関連性Slack</a> ：#quepidチャンネルに参加する</p></li></ul><p><a href="https://opensourceconnections.com/"><strong>Open Source Connections</strong></a> と提携して 検索機能と AI 機能を変革し、チームが継続的に進化できるようにします。当社の実績は世界中に広がっており、クライアントは一貫して検索品質、チーム能力、ビジネス パフォーマンスの劇的な改善を達成しています。詳細については、<a href="https://opensourceconnections.com/contact/">今すぐお問い合わせください</a>。</p>]]></content:encoded>
    <link>https://www.elastic.co/search-labs/blog/quepid-judgement-lists</link>
    <guid isPermaLink="true">https://www.elastic.co/search-labs/blog/quepid-judgement-lists</guid>
    <category><![CDATA[関連性]]></category>
    <dc:creator><![CDATA[Daniel Wrigley]]></dc:creator>
    <enclosure url="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blte6779c72c7a42a5a/6a17e6623e9e45acf0ba146b/307c1774bd31f92bb4aa7b69e1a6796240465100-1600x914.png" length="0" type="image/png"/>
    <pubDate>Mon, 26 May 2025 00:00:00 GMT</pubDate>
  </item>
  </channel>
</rss>