<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0">
  <channel>
    <title><![CDATA[Sofia Vasileva - Elasticsearch Labs]]></title>
    <description><![CDATA[Articles and tutorials from the Search team at Elastic]]></description>
    <copyright><![CDATA[© 2026. Elasticsearch B.V. All Rights Reserved]]></copyright>
    <image>
      <title><![CDATA[Sofia Vasileva - Elasticsearch Labs]]></title>
      <url>https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt1121c0bf0e8a6e65/6a88da6340a1841030ef456f/search-labs-thumbnail.png</url>
      <link>https://www.elastic.co/fr/search-labs/author/sofia-vasileva</link>
    </image>
    <link>https://www.elastic.co/fr/search-labs/author/sofia-vasileva</link>
    <atom:link href="https://www.elastic.co/fr/search-labs/rss/author/sofia-vasileva.xml" rel="self" type="application/rss+xml"/>
    <language><![CDATA[fr]]></language>
    <lastBuildDate>Fri, 18 Sep 2026 11:48:24 GMT</lastBuildDate>
  <item>
    <title><![CDATA[jina-embeddings-v5-text : modèles d’embeddings textuels compacts et de pointe pour la recherche et les applications intelligentes]]></title>
    <description><![CDATA[Présentation des modèles jina-embeddings-v5-text, dont jina-embeddings-v5-text-small et jina-embeddings-v5-text-nano, ainsi que de leur utilisation en tant que modèles d’embeddings multilingues via Elastic Inference Service (EIS).]]></description>
    <content:encoded><![CDATA[<p>Jina AI et Elastic lancent <code>jina-embeddings-v5-text</code>, une famille de modèles d’embeddings textuels compacts et hautes performances, offrant des performances de pointe pour des modèles de taille comparable sur l’ensemble des principaux types de tâches.</p><p>La famille comprend deux modèles :</p><ul><li><p><code>jina-embeddings-v5-text-small</code></p></li><li><p><code>jina-embeddings-v5-text-nano</code></p></li></ul><p>Ces modèles sont le fruit d’une nouvelle méthode d’entraînement innovante pour les modèles d’embeddings. Tous deux surpassent des modèles bien plus volumineux, tout en réduisant les besoins en mémoire et en ressources de calcul, et en accélérant les temps de réponse.</p><p>Le modèle <code>jina-embeddings-v5-text-small</code> compte 677 millions de paramètres, prend en charge une fenêtre de contexte d’entrée de 32 768 tokens et génère par défaut des embeddings de 1 024 dimensions.</p><p><code>jina-embeddings-v5-text-nano</code> pèse environ un tiers de la taille de son homologue, avec 239 millions de paramètres et une fenêtre de contexte d’entrée de 8 192 tokens, offrant des embeddings de 768 dimensions.</p><p>Nom du modèle</p><p>Taille totale</p><p>Taille de la fenêtre contextuelle d'entrée</p><p>Taille des embeddings</p><p>jina-v5-text-small</p><p>677M paramètres</p><p>32 768 tokens</p><p>1 024 dimensions</p><p>jina-v5-text-nano</p><p>239M paramètres</p><p>8 192 tokens</p><p>768 dimensions</p><p>Ces deux modèles se classent parmi les meilleurs pour les performances globales au benchmark MTEB (<a href="https://huggingface.co/spaces/mteb/leaderboard">Massive Text Embedding Benchmark</a>) et au benchmark multilingue MTEB. Parmi les modèles ayant moins de 500 millions de paramètres, <code>jina-embeddings-v5-text-nano</code> est le plus performant, malgré moins de 250 millions de paramètres, et <code>jina-embeddings-v5-text-small</code> est le leader parmi les modèles d’embeddings multilingues de moins de 750 millions de paramètres.</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltb2f2be8618f5e240/6a17dbb83e9e45b7f3ba1344/d97126285fa196c3045b1913b7754e4b186c1e4c-1300x1100.png" alt="jina-embeddings-v5-text Scores MMTEB" /><p>Ces modèles sont disponibles via Elastic Inference Service (EIS), via une API en ligne, et peuvent également être déployés en local. Pour savoir comment accéder aux modèles <code>jina-embeddings-v5-text</code>, consultez la section « <strong>Commencer</strong> » ci-dessous.</p><p>Les modèles d’embeddings et l’indexation sémantique améliorent considérablement la précision des algorithmes de recherche, tout en répondant à de nombreux autres cas d’usage liés à la similarité sémantique et à l’extraction de sens, par exemple :</p><ul><li><p>Détection de textes en double.</p></li><li><p>Reconnaissance des paraphrases et des traductions.</p></li><li><p>Découverte de thématiques.</p></li><li><p>Moteurs de recommandation.</p></li><li><p>Analyse des sentiments et des intentions.</p></li><li><p>Filtrage des spams.</p></li><li><p>Et bien d'autres encore.</p></li></ul><h2><strong>Fonctionnalités</strong></h2><p>Cette nouvelle famille de modèles propose un ensemble de fonctionnalités conçues pour améliorer la pertinence et réduire les coûts.</p><h3>Optimisation des tâches</h3><p>Nous avons optimisé les modèles <code>jina-embeddings-v5-text</code> pour quatre grands types de tâches :</p><p>Tâche</p><p>Exemples de cas d'utilisation</p><p>Récupération</p><p>Recherche à l’aide de requêtes en langage naturel et récupération des correspondances les plus pertinentes au sein d’une collection de documents.</p><p>Correspondance de texte</p><p>Similarité sémantique, déduplication, alignement des paraphrases et des traductions, et plus encore.</p><p>Clustering</p><p>Découverte de thématiques, organisation automatique de collections de documents.</p><p>Classification</p><p>Catégorisation de documents, analyse des sentiments et détection des intentions, tâches similaires.</p><p>Optimiser un modèle pour une tâche implique généralement de faire des compromis sur une autre. La plupart des modèles d’embeddings n’offrent donc des performances compétitives que pour un seul type de tâche. En revanche, les modèles <code>jina-embeddings-v5-text</code> peuvent se spécialiser dans les quatre catégories sans compromettre l’entraînement, grâce à des <a href="https://arxiv.org/abs/2106.09685">adaptateurs Low-Rank Adaptation (LoRA)</a> spécifiques à chaque tâche.</p><p>Les adaptateurs LoRA sont une sorte de plugin pour un modèle d’IA, qui en modifie fortement le comportement tout en n’augmentant que légèrement sa taille totale. Au lieu d’avoir un modèle distinct pour chaque tâche, chacun comportant des centaines de millions de paramètres, la famille de modèles <code>jina-embeddings-v5-text</code> vous permet d’utiliser un seul modèle, associé à un adaptateur LoRA compact pour chaque tâche. Cela permet d’économiser de la mémoire, de l’espace de stockage et de réduire les coûts d’inférence.</p><h3>Troncature des embeddings</h3><p>Nous avons entraîné les modèles <code>jina-embeddings-v5-text</code> avec <a href="https://arxiv.org/abs/2205.13147">Matryoshka Representation Learning (MRL)</a>, ce qui vous permet de réduire la taille de vos embeddings tout en limitant l’impact sur leur qualité.</p><p>Par défaut, <code>jina-embeddings-v5-text-small</code> génère des vecteurs d’embeddings de 1 024 dimensions, chaque valeur étant représentée sur 16 bits, ce qui porte la taille de chaque embedding à 2 Ko. Pour une vaste collection de documents, cela peut représenter un volume de données important à stocker. La recherche dans une base de données vectorielle remplie d’embeddings est proportionnelle à la taille de la base et au nombre de dimensions de chaque vecteur stocké.</p><p>Vous pouvez toutefois réduire de moitié la taille des embeddings (en supprimant 512 des 1 024 dimensions), diminuer l’espace occupé de moitié et doubler la vitesse de recherche. Cela a un impact sur les performances. Supprimer des informations réduit la précision. Mais comme le montre le graphique ci-dessous, supprimer la moitié de l’embedding n’entraîne qu’une légère baisse des performances :</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt8deea6ee69a6b77d/6a17dbba0b0bed2217dd347e/f11969682c81bcf22b5b29a6204ba6ec40471b3d-900x700.png" alt="Taille des embeddings de jina-embeddings-v5-text-small et jina-embeddings-v5-text-nano" /><p>Tant que vos embeddings comportent au moins 256 dimensions, la perte de précision devrait rester relativement faible. En dessous de ce seuil, en revanche, la pertinence et la précision se dégradent rapidement.</p><p>La troncature des embeddings de cette manière vous permet de gérer vos arbitrages entre précision et coûts de calcul. Vous disposez ainsi des leviers nécessaires pour obtenir des gains d’efficacité significatifs et réduire sensiblement les coûts de votre Search AI.</p><h3>Quantification robuste</h3><p>La <em>quantification </em>constitue une autre méthode pour réduire la taille des embeddings. Au lieu de supprimer une partie de chaque embedding, la quantification diminue la précision des valeurs numériques qui le composent. Les modèles <code>jina-embeddings-v5-text</code> génèrent des embeddings avec des valeurs sur 16 bits, mais nous pouvons arrondir ces valeurs, ce qui réduit leur précision ainsi que le nombre de bits nécessaires pour les stocker. Dans le cas le plus extrême, il est possible de ramener chaque valeur à un seul bit (0 ou 1), ce qui compresse les embeddings par défaut de 1 024 dimensions de <code>jina-embeddings-v5-text</code>de 2 kilooctets à 128 octets, soit une réduction de 94 % grâce à la seule quantification binaire. Comme pour la troncature, cela permet de réaliser d’importantes économies de mémoire et de ressources de calcul. Cependant, à l’instar de la troncature, la quantification réduit la précision des embeddings.</p><p>Nous avons entraîné les modèles <code>jina-embeddings-v5-text</code> pour fonctionner avec la <a href="https://www.elastic.co/docs/reference/elasticsearch/mapping-reference/bbq">Better Binary Quantization (BBQ)</a> d’<a href="https://www.elastic.co/fr/elasticsearch">Elasticsearch</a>, en minimisant la perte de précision. Les tests comparatifs des embeddings binarisés issus de ces modèles montrent des performances presque équivalentes à celles de leurs versions non binarisées. Consultez <a href="https://arxiv.org/abs/2602.15547">le rapport technique</a> pour accéder à des études d’ablation détaillées sur les performances de la binarisation.</p><h3>Performance multilingue</h3><p>De nombreux modèles d’embeddings sont multilingues, car ils ont été entraînés sur des corpus couvrant un grand nombre de langues. Cela ne signifie pas pour autant qu’ils offrent des performances équivalentes dans toutes les langues prises en charge.</p><p>Nous avons identifié 211 langues dans le benchmark multilingue MTEB et les avons isolées afin de comparer nos modèles à des modèles similaires, langue par langue. L’image ci-dessous synthétise nos résultats sous la forme d’une carte thermique. Chaque zone correspond à une langue (identifiée par son code ISO-639) et plus la couleur est verte, meilleures sont les performances du modèle par rapport à la moyenne des modèles similaires :</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltee08033102f46c4f/6a17dbbc420229503229f4c8/852ac5d0f1977bb0c1124d87f8863a9bb94eb7da-1600x765.png" alt="Langues de jina-embeddings-v5-text-nano et jina-embeddings-v5-text-small dans le benchmark multilingue MTEB" /><p>Bien que la précision varie selon les langues, les modèles <code>jina-embeddings-v5-text</code> atteignent des performances de pointe, ou proches de l’état de l’art, dans la majorité des langues du monde.</p><p>Pour en savoir plus sur les performances multilingues, consultez le <a href="https://arxiv.org/abs/2602.15547">rapport technique</a><a href="https://arxiv.org/abs/2602.15547"><code>jina-embeddings-v5-text</code></a> .</p><h2><strong>Jina in Elastic : une IA native de pointe pour la recherche</strong></h2><p>Avec les modèles <code>jina-embeddings-v5-text</code> sur EIS, vous exécutez des modèles d’embeddings multilingues hautes performances de manière native dans <a href="https://www.elastic.co/fr/elasticsearch">Elasticsearch</a>, avec une inférence entièrement gérée, accélérée par GPU, et sans infrastructure à provisionner ni à faire évoluer. Les modèles <code>jina-embeddings-v5-text</code> enrichissent le catalogue de modèles EIS en proposant des modèles multilingues compacts, tirant parti des dernières avancées en matière d’IA. Ces modèles affichent des performances de pointe sur les benchmarks de recherche d’information et d’analyse de données standard, tout en offrant une prise en charge multilingue inégalée à l’échelle mondiale.</p><p>Avec deux modèles de tailles très différentes, vous pouvez déterminer celui qui convient le mieux à vos applications et à votre budget. De plus, grâce à des embeddings robustes qui restent performants lorsqu’ils sont tronqués à des tailles plus réduites ou quantifiés avec une précision moindre, les modèles <code>jina-embeddings-v5-text </code>offrent des opportunités supplémentaires d’économies concrètes en matière de stockage, de coûts de calcul et de latence de traitement.</p><p>Avec la famille <code>jina-embeddings-v5-text</code>, Jina Reranker et la recherche vectorielle rapide et BM25 d’Elastic, vous bénéficiez désormais d’une <a href="https://www.elastic.co/docs/solutions/search/hybrid-search">recherche hybride</a> de bout en bout, de pointe, proposée par Elastic. Lorsque vous avez besoin des résultats les plus pertinents, que ce soit pour des pipelines de génération augmentée par récupération (RAG), des applications de recherche ou des analyses de données, Elastic associé aux modèles Search AI de Jina vous garantit une qualité robuste et un excellent rapport coût-efficacité.</p><h2><strong>Premiers pas</strong></h2><p>Les modèles <code>jina-embeddings-v5-text</code> sont entièrement intégrés dans <a href="https://www.elastic.co/docs/explore-analyze/elastic-inference/eis">EIS</a>, et vous pouvez les utiliser en définissant lechamp <strong><code>type</code></strong>sur<strong><code>semantic_text</code></strong> lors de la création de votre index et en spécifiant le modèle (<code>jina-embeddings-v5-text-small</code> ou <code>jina-embeddings-v5-text-nano</code>) dans lechamp <code>inference_id</code>, comme dans cet exemple :</p>PUT multilingual-semantic-index
{
  "mappings": {
    "properties": {
      "content": {
        "type": "semantic_text",
        "inference_id": ".jina-embeddings-v5-text-small"
      }
    }
  }
}

# Ingest data about France
POST multilingual-semantic-index/_doc
{
  "content": "The capital of France is Paris"}

GET multilingual-semantic-index/_search
{
  "query": {
    "semantic": {
      "field": "content",
      "query": "What is the French capital?"
    }
  }
}<p><a href="https://www.elastic.co/fr/elasticsearch">Elasticsearch</a> sélectionne automatiquement l’adaptateur LoRA approprié lors de l’indexation et de la recherche. Les dimensions de l'intégration (voir la section « <strong>Troncature des intégrations »</strong> ci-dessus) peuvent être définies lors de la <a href="https://www.elastic.co/docs/api/doc/elasticsearch/operation/operation-inference-put">création d'un point de terminaison d'inférence personnalisé</a>.</p><p>Consultez la <a href="https://www.elastic.co/docs/reference/elasticsearch/mapping-reference/dense-vector">documentation Elasticsearch</a> pour plus d'informations sur l'utilisation des modèles <strong><code>jina-embeddings-v5-text</code></strong> .</p><h2><strong>Plus d'informations</strong></h2><p>Pour en savoir plus sur les modèles <code>jina-embeddings-v5-text</code>, lisez les <a href="https://jina.ai/news/jina-embeddings-v5-text-distilling-4b-quality-into-sub-1b-multilingual-embeddings/">notes de publication sur le blog de Jina AI</a> et le <a href="https://arxiv.org/abs/2602.15547">rapport technique</a>, qui contiennent des informations techniques détaillées sur les performances et la nouvelle procédure de formation innovante de Jina AI. Pour plus d'informations sur le téléchargement et l'exécution de ces modèles localement, consultez la <a href="https://huggingface.co/collections/jinaai/jina-embeddings-v5-text"><code>jina-embeddings-v5-text</code></a><a href="https://huggingface.co/collections/jinaai/jina-embeddings-v5-text"> page de la collection</a> sur Hugging Face.</p><p>Les modèles Jina AI sont disponibles sous <a href="https://spdx.org/licenses/CC-BY-NC-4.0">licence CC-BY-NC-4.0</a>, vous êtes donc libre de les télécharger et de les essayer, mais pour un usage commercial, veuillez contacter <a href="https://www.elastic.co/contact?pg=global&amp;plcmt=nav&amp;cta=205352">les ventes d’Elastic</a>.</p>]]></content:encoded>
    <link>https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text</link>
    <guid isPermaLink="true">https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text</guid>
    <category><![CDATA[Jina AI]]></category>
    <dc:creator><![CDATA[Scott Martens,Sofia Vasileva]]></dc:creator>
    <enclosure url="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltfd81be89ffe5b036/6a17dbbd445de9b55e4cffd1/e98dd30ab925b4bb32830228d71a1a51d02a0917-1600x840.png" length="0" type="image/png"/>
    <pubDate>Mon, 23 Feb 2026 00:00:00 GMT</pubDate>
  </item>
  </channel>
</rss>