<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0">
  <channel>
    <title><![CDATA[Sofia Vasileva - Elasticsearch Labs]]></title>
    <description><![CDATA[Articles and tutorials from the Search team at Elastic]]></description>
    <copyright><![CDATA[© 2026. Elasticsearch B.V. All Rights Reserved]]></copyright>
    <image>
      <title><![CDATA[Sofia Vasileva - Elasticsearch Labs]]></title>
      <url>https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt1121c0bf0e8a6e65/6a88da6340a1841030ef456f/search-labs-thumbnail.png</url>
      <link>https://www.elastic.co/jp/search-labs/author/sofia-vasileva</link>
    </image>
    <link>https://www.elastic.co/jp/search-labs/author/sofia-vasileva</link>
    <atom:link href="https://www.elastic.co/jp/search-labs/rss/author/sofia-vasileva.xml" rel="self" type="application/rss+xml"/>
    <language><![CDATA[jp]]></language>
    <lastBuildDate>Tue, 29 Sep 2026 07:19:47 GMT</lastBuildDate>
  <item>
    <title><![CDATA[jina-embeddings-v5-text：検索やインテリジェントアプリケーション向けのコンパクトで最先端のテキスト埋め込み]]></title>
    <description><![CDATA[jina-embeddings-v5-text-smallとjina-embeddings-v5-text-nanoを含むjina-embeddings-v5-textモデルを紹介し、Elastic Inference Service（EIS）を介してこれらの多言語埋め込みモデルを使用する方法を説明します。]]></description>
    <content:encoded><![CDATA[<p>Jina AIとElasticは、<code>jina-embeddings-v5-text</code>をリリースします。これは、すべての主要なタスクタイプにおいて、同等サイズのモデルの中で最先端のパフォーマンスを備えた、新しい高性能でコンパクトなテキスト埋め込みモデルのファミリーです。</p><p>このファミリーには2つのモデルが含まれます。</p><ul><li><p><code>jina-embeddings-v5-text-small</code></p></li><li><p><code>jina-embeddings-v5-text-nano</code></p></li></ul><p>これらのモデルは、埋め込みモデルの革新的な新しいトレーニングレシピの成果です。いずれも、同等サイズのモデルよりも何倍も優れたパフォーマンスを発揮し、メモリとコンピューティングリソースを節約し、リクエストへの応答を高速化します。</p><p><code>jina-embeddings-v5-text-small</code>モデルは6億7700万パラメーターを持ち、32768トークンのインプットコンテキストウィンドウをサポートし、デフォルトで1024次元の埋め込みを生成します。</p><p><code>jina-embeddings-v5-text-nano</code> はその兄弟の約3分の1のサイズで、239Mのパラメーターと8192トークンのインプットコンテキストウィンドウを持ち、スリムな768次元の埋め込みを生成します。</p><p>モデル名</p><p>合計サイズ</p><p>インプットコンテキストウィンドウサイズ</p><p>埋め込みサイズ</p><p>jina-v5-text-small</p><p>677M パラメータ</p><p>32768トークン</p><p>1024次元</p><p>jina-v5-text-nano</p><p>2億3900万パラメーター</p><p>8192 トークン</p><p>768次元</p><p>これら2つのモデルは、MMTEB（<a href="https://huggingface.co/spaces/mteb/leaderboard">Multilingual MTEB</a>）ベンチマークの総合的なパフォーマンスにおいてクラス最高です。5億未満のパラメーターを持つモデルの中で<code>jina-embeddings-v5-text-nano</code>はトップパフォーマーであり、2億5000万未満のパラメータを持ちながらも、7億5000万未満のパラメータを持つ多言語埋め込みモデルの中で<code>jina-embeddings-v5-text-small</code>モデルがリーダーです。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltb2f2be8618f5e240/6a17dbb83e9e45b7f3ba1344/d97126285fa196c3045b1913b7754e4b186c1e4c-1300x1100.png" alt="jina-embeddings-v5-text MMTEBスコア" /><p>これらのモデルは、Elastic Inference Service（EIS）やオンラインAPIを介して利用でき、ローカルホスティングでも利用できます。<code>jina-embeddings-v5-text</code>モデルにアクセスする方法については、以下の「<strong>はじめに</strong>」セクションを参照してください。</p><p>埋め込みモデルとセマンティックインデックスにより、検索アルゴリズムの精度が劇的に向上するだけでなく、以下のようなセマンティック類似性や意味抽出を伴うタスクにもさまざまな用途があります。</p><ul><li><p>重複したテキストの検索。</p></li><li><p>言い換えや翻訳の認識。</p></li><li><p>トピックの発見。</p></li><li><p>推奨エンジン。</p></li><li><p>感情分析と意図分析。</p></li><li><p>スパムフィルタリング。</p></li><li><p>その他多数。</p></li></ul><h2><strong>特徴</strong></h2><p>この新しいモデルファミリーには、関連性を高め、コストを削減するために設計された多くの特徴があります。</p><h3>タスクの最適化</h3><p>私たちは、<code>jina-embeddings-v5-text</code> のモデルを4つの幅広いタスクタイプに最適化しました。</p><p>タスク</p><p>ユースケースの例</p><p>検索</p><p>自然言語クエリを使用して検索し、ドキュメントのコレクション内で最も関連性の高い一致を取得。</p><p>テキストマッチング</p><p>意味的類似性、重複除去、言い換えや翻訳の整合性など。</p><p>クラスタリング</p><p>トピックの検出、ドキュメントコレクションの自動整理。</p><p>分類</p><p>ドキュメントの分類、感情と意図の検出、同様のタスク。</p><p>あるタスクを最適化するということは、通常、別のタスクを妥協する必要があることを意味します。そのため、ほとんどの埋め込みモデルは、1種類のタスクに対してのみ競争力のあるパフォーマンスを発揮します。しかし、<code>jina-embeddings-v5-text</code>モデルは、タスク固有の<a href="https://arxiv.org/abs/2106.09685">Low-Rank Adaptation（LoRA）アダプター</a>をトレーニングすることで、妥協することなく4つのすべての分野に特化できます。</p><p>LoRAアダプターはAIモデルのプラグインの一種であり、全体のサイズをわずかに増やすだけでAIモデルの動作を劇的に変化させます。<code>jina-embeddings-v5-text</code> モデルファミリーでは、タスクごとにモデル全体を用意し、それぞれに何億ものパラメーターを持たせる代わりに、各タスクにコンパクトなLoRaアダプターを備えた1つのモデルだけを使用できます。これによりメモリ、ストレージ容量、推論コストを節約できます。</p><h3>埋め込みの切り捨て</h3><p>私たちは、 <a href="https://arxiv.org/abs/2205.13147">Matryoshka Representation Learning</a>を使用して<code>jina-embeddings-v5-text</code>モデルをトレーニングしました。これにより、品質への影響を最小限に抑えながら、埋め込みを小さなサイズに削減できます。</p><p>デフォルトでは、<code>jina-embeddings-v5-text-small</code> は1024次元の埋め込みベクトルを生成し、各ベクトルは16ビットで表されます。大量のドキュメントコレクションの場合、格納するデータ量が多くなり、埋め込みで満たされたベクトルデータベースでの検索は、データベースのサイズと各格納されたベクトルが持つ次元の数に比例します。</p><p>しかし、埋め込みのサイズを半分に減らす（1024次元のうち512次元を切り捨てる）だけで、占有スペースを半分にしながら検索速度を2倍にすることができます。これはパフォーマンスに影響を与えます。情報を捨てると精度が低下しますが、下のグラフが示すように、埋め込みの半分を取り除いてもパフォーマンスはわずかしか低下しません。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt8deea6ee69a6b77d/6a17dbba0b0bed2217dd347e/f11969682c81bcf22b5b29a6204ba6ec40471b3d-900x700.png" alt="jina-embeddings-v5-text-small &amp; jina-embeddings-v5-text-nano 埋め込みサイズ" /><p>埋め込みが少なくとも256次元であれば、精度の損失は比較的小さいはずです。しかし、そのレベルを下回ると、関連性と正確性はすぐに低下します。</p><p>このような埋め込みの切り捨てにより、ユーザーは精度と計算コストのバランスを自分で管理できるようになり、検索AIから大きな効率の向上と大幅なコスト削減を実現するツールを提供します。</p><h3>堅牢な量子化</h3><p><em>量子化</em>は埋め込みのサイズを縮小するもう一つの方法です。量子化では、各埋め込みの一部を破棄するのではなく、埋め込み内の数値の精度を下げます。<code>jina-embeddings-v5-text</code> モデルは16ビット数値で埋め込みを生成しますが、これらの数値を四捨五入して精度と格納に必要なビット数を減らすことができます。最も極端な場合では、各数値を1ビット（0または1）に減らすことで、<code>jina-embeddings-v5-text</code>のデフォルトの1024次元の埋め込みを2キロバイトから128バイトに圧縮できます。これは、バイナリ量子化だけで94％の削減になります。切り捨ての場合と同様に、これによりメモリと計算コストが大幅に節約されますが、切り捨てと同様に、量子化によって埋め込みの精度は低下します。</p><p><code>jina-embeddings-v5-text</code>モデルは<a href="https://www.elastic.co/jp/elasticsearch">Elasticsearch</a>の<a href="https://www.elastic.co/docs/reference/elasticsearch/mapping-reference/bbq">Better Binary Quantization</a>に対応し、精度の損失を最小限に抑えるようにトレーニングされており、これらのモデルからの二値化埋め込みのベンチマークテストでは、非二値化モデルとほぼ同等の性能を示しています。二値化性能に関する詳細なアブレーション研究については<a href="https://arxiv.org/abs/2602.15547">テクニカルレポートを</a>ご参照ください。</p><h3>多言語パフォーマンス</h3><p>多くの埋め込みモデルは、多数の言語を含む素材でトレーニングされているため、多言語対応です。しかし、サポートされているすべての言語で、すべてが同じように優れたパフォーマンスを発揮するわけではありません。</p><p>MMTEBの多言語ベンチマークで211の言語を特定し、それらを分離して、言語ごとにモデルを類似のモデルと比較できるようにしました。下の画像は、私たちの結果をヒートマップとしてまとめたものです。各パッチは言語（ISO-639コードで識別）であり、緑色が濃くなるほど、類似モデルの平均と比較してモデルのパフォーマンスが優れていることを示します。</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltee08033102f46c4f/6a17dbbc420229503229f4c8/852ac5d0f1977bb0c1124d87f8863a9bb94eb7da-1600x765.png" alt="jina-embeddings-v5-text-nanoおよびjina-embeddings-v5-text-small言語（MMTEB多言語ベンチマーク）" /><p>正確さは言語によって異なりますが、<code>jina-embeddings-v5-text</code> モデルは最先端か、世界のほとんどの言語でほぼ最新です。</p><p>詳細な多言語パフォーマンスについては、<a href="https://arxiv.org/abs/2602.15547"><code>jina-embeddings-v5-text</code></a><a href="https://arxiv.org/abs/2602.15547">テクニカルレポート</a>を参照してください。</p><h2><strong>ElasticにおけるJina：最先端のネイティブAIによる検索</strong></h2><p><code>jina-embeddings-v5-text</code>モデルをEISで使用することで、<a href="https://www.elastic.co/jp/elasticsearch">Elasticsearch</a>でネイティブに高パフォーマンスの多言語埋め込みモデルを実行できます。これは、完全に管理されたGPUアクセラレーションによる推論で、インフラを提供したりスケールする必要はありません。<code>jina-embeddings-v5-text</code> モデルは、最新のAI開発によって強化されたコンパクトで多言語対応のモデルで、成長するEISモデルカタログを拡張します。これらのモデルは、情報検索と標準データ分析ベンチマークにおいて最先端のパフォーマンスを発揮し、他に類を見ない世界規模の多言語サポートを提供します。</p><p>サイズが大きく異なる2つのモデルが用意されているため、ユーザーは用途や予算に応じてどちらが最適かを判断できます。さらに、より小さなサイズに切り詰められたり、より低い精度に量子化されたりしてもパフォーマンスを維持する堅牢な埋め込みにより、<code>jina-embeddings-v5-text </code>モデルはストレージと計算コストおよび処理遅延においてさらなる具体的な節約の機会を提供します。</p><p><code>jina-embeddings-v5-text</code>ファミリー、Jina Reranker、Elasticの高速ベクトルおよびBM25検索により、ユーザーはElasticのエンドツーエンドの最先端の<a href="https://www.elastic.co/docs/solutions/search/hybrid-search">ハイブリッド検索</a>にアクセスできるようになりました。最も関連性の高い結果が必要な場合、Retrieval-Augmented Generation（RAG）パイプライン、検索アプリケーション、またはデータ分析において、ElasticとJinaの検索AIモデルは、堅固で費用対効果の高い品質を提供します。</p><h2><strong>はじめに</strong></h2><p><code>jina-embeddings-v5-text</code>モデルは<a href="https://www.elastic.co/docs/explore-analyze/elastic-inference/eis">EIS</a>に完全に統合されており、インデックス作成時に<strong><code>type</code></strong>フィールドを<strong><code>semantic_text</code></strong>に設定し、<code>inference_id</code>フィールドでモデル（<code>jina-embeddings-v5-text-small</code>または<code>jina-embeddings-v5-text-nano</code>）を指定することで使用できます（次の例を参照）</p>PUT multilingual-semantic-index
{
  "mappings": {
    "properties": {
      "content": {
        "type": "semantic_text",
        "inference_id": ".jina-embeddings-v5-text-small"
      }
    }
  }
}

# Ingest data about France
POST multilingual-semantic-index/_doc
{
  "content": "The capital of France is Paris"}

GET multilingual-semantic-index/_search
{
  "query": {
    "semantic": {
      "field": "content",
      "query": "What is the French capital?"
    }
  }
}<p><a href="https://www.elastic.co/jp/elasticsearch">Elasticsearch</a>はインデキシングおよび検索時に適切なLoRAアダプターを自動的に選択します。埋め込み次元（上記の「<strong>埋め込みの切り捨て</strong>」セクション参照）は、<a href="https://www.elastic.co/docs/api/doc/elasticsearch/operation/operation-inference-put">カスタム推論エンドポイントを作成</a>する際に設定できます。</p><p><strong><code>jina-embeddings-v5-text</code></strong>モデルの利用については <a href="https://www.elastic.co/docs/reference/elasticsearch/mapping-reference/dense-vector">Elasticsearchのドキュメント</a>を参照してください。</p><h2><strong>詳細情報</strong></h2><p><code>jina-embeddings-v5-text</code>モデルについて詳しくは、<a href="https://jina.ai/news/jina-embeddings-v5-text-distilling-4b-quality-into-sub-1b-multilingual-embeddings/">Jina AIブログのリリースノート</a>と<a href="https://arxiv.org/abs/2602.15547">テクニカルレポート</a>をお読みください。パフォーマンスとJina AIの革新的な新しいトレーニング手順に関するより詳細な技術情報が記載されています。これらのモデルのローカルダウンロードや運用については、Hugging Faceの<a href="https://huggingface.co/collections/jinaai/jina-embeddings-v5-text"><code>jina-embeddings-v5-text</code></a><a href="https://huggingface.co/collections/jinaai/jina-embeddings-v5-text">コレクションページ</a>をご覧ください。</p><p>Jina AIモデルは <a href="https://spdx.org/licenses/CC-BY-NC-4.0">CC-BY-NC-4.0ライセンス</a>の下で利用可能ですので、自由にダウンロードして試すことができますが、商用利用の場合は <a href="https://www.elastic.co/contact?pg=global&amp;plcmt=nav&amp;cta=205352">Elastic Sales</a>までお問い合わせください。</p>]]></content:encoded>
    <link>https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text</link>
    <guid isPermaLink="true">https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text</guid>
    <category><![CDATA[Jina AI]]></category>
    <dc:creator><![CDATA[Scott Martens,Sofia Vasileva]]></dc:creator>
    <enclosure url="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltfd81be89ffe5b036/6a17dbbd445de9b55e4cffd1/e98dd30ab925b4bb32830228d71a1a51d02a0917-1600x840.png" length="0" type="image/png"/>
    <pubDate>Mon, 23 Feb 2026 00:00:00 GMT</pubDate>
  </item>
  </channel>
</rss>