<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0">
  <channel>
    <title><![CDATA[Sofia Vasileva - Elasticsearch Labs]]></title>
    <description><![CDATA[Articles and tutorials from the Search team at Elastic]]></description>
    <copyright><![CDATA[© 2026. Elasticsearch B.V. All Rights Reserved]]></copyright>
    <image>
      <title><![CDATA[Sofia Vasileva - Elasticsearch Labs]]></title>
      <url>https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt1121c0bf0e8a6e65/6a88da6340a1841030ef456f/search-labs-thumbnail.png</url>
      <link>https://www.elastic.co/pt/search-labs/author/sofia-vasileva</link>
    </image>
    <link>https://www.elastic.co/pt/search-labs/author/sofia-vasileva</link>
    <atom:link href="https://www.elastic.co/pt/search-labs/rss/author/sofia-vasileva.xml" rel="self" type="application/rss+xml"/>
    <language><![CDATA[pt]]></language>
    <lastBuildDate>Mon, 21 Sep 2026 15:59:56 GMT</lastBuildDate>
  <item>
    <title><![CDATA[jina-embeddings-v5-text: Incorporações de texto compactas e de última geração para busca e aplicações inteligentes]]></title>
    <description><![CDATA[Apresentação dos modelos jina-embeddings-v5-text models, including jina-embeddings-v5-text-small e jina-embeddings-v5-text-nano explicando como usar esses modelos de incorporação multilíngue por meio do Elastic Inference Service (EIS).]]></description>
    <content:encoded><![CDATA[<p>A Jina AI e a Elastic estão lançando <code>jina-embeddings-v5-text</code>, uma família de novos modelos compactos de incorporação de texto de alto desempenho, com desempenho de última geração para modelos de tamanho comparável em todos os principais tipos de tarefas.</p><p>A família inclui dois modelos:</p><ul><li><p><code>jina-embeddings-v5-text-small</code></p></li><li><p><code>jina-embeddings-v5-text-nano</code></p></li></ul><p>Esses modelos são o resultado bem-sucedido de uma nova receita inovadora de treinamento para incorporação de modelos. Ambos superam modelos muitas vezes maiores que eles, gerando economia de memória e recursos computacionais e respondendo mais rápido a solicitações.</p><p>O modelo <code>jina-embeddings-v5-text-small</code> possui 677 milhões de parâmetros, é compatível com uma janela de contexto de entrada de 32.768 tokens e gera embeddings de 1.024 dimensões por padrão.</p><p><code>jina-embeddings-v5-text-nano</code> Pesa cerca de um terço do tamanho da nova versão, com 239 milhões de parâmetros e uma janela de contexto de entrada de 8.192 tokens, resultando em embeddings de dimensão 768 compactos.</p><p>Nome do modelo</p><p>Tamanho total</p><p>Tamanho da janela de contexto de entrada</p><p>Tamanho do embedding</p><p>jina-v5-text-small</p><p>677M params</p><p>32.768 tokens</p><p>1.024 dims</p><p>jina-v5-text-nano</p><p>239M params</p><p>8.192 tokens</p><p>768 dimensões</p><p>Esses dois modelos são os melhores da categoria para o desempenho geral do benchmark MMTEB (<a href="https://huggingface.co/spaces/mteb/leaderboard">Multilingual MTEB</a>). Entre os modelos com menos de 500M, <code>jina-embeddings-v5-text-nano</code> é o de melhor desempenho, apesar de ter menos de 250M, e o modelo <code>jina-embeddings-v5-text-small</code> é o líder entre os modelos de embedding multilíngue com menos de 750M.</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltb2f2be8618f5e240/6a17dbb83e9e45b7f3ba1344/d97126285fa196c3045b1913b7754e4b186c1e4c-1300x1100.png" alt="jina-embeddings-v5-text pontuações MMTEB" /><p>Esses modelos estão disponíveis por meio do Elastic Inference Service (EIS), de uma API online e para hospedagem local. Para instruções sobre como acessar os modelos <code>jina-embeddings-v5-text</code>, veja a seção "<strong>Começar</strong>" abaixo.</p><p>Modelos de incorporação e indexação semântica aumentam muito a precisão dos algoritmos de busca, mas também têm uma variedade de outros usos para tarefas envolvendo similaridade semântica e extração de significado, por exemplo:</p><ul><li><p>Encontrando textos duplicados.</p></li><li><p>Reconhecendo paráfrases e traduções.</p></li><li><p>Descoberta de tópicos.</p></li><li><p>Mecanismos de recomendação.</p></li><li><p>Análise de sentimentos e intenções.</p></li><li><p>Filtragem de spam.</p></li><li><p>E muitos outros.</p></li></ul><h2><strong>Recursos</strong></h2><p>Essa nova família de modelos possui uma série de recursos projetados para aumentar a relevância e reduzir custos.</p><h3>Otimização de tarefas</h3><p>Otimizamos os modelos <code>jina-embeddings-v5-text</code> para quatro tipos amplos de tarefas:</p><p>Tarefa</p><p>Exemplos de casos de uso</p><p>Recuperação</p><p>Busca com consultas em linguagem natural e recuperação das correspondências mais relevantes em um conjunto de documentos.</p><p>Correspondência de texto</p><p>Similaridade semântica, desduplicação, alinhamento de paráfrases e traduções, e muito mais.</p><p>Clustering</p><p>Descoberta de tópicos, organização automática de coleções de documentos.</p><p>Classificação</p><p>Categorização de documentos, detecção de sentimentos e intenções, tarefas similares.</p><p>Otimizar para uma tarefa geralmente significa ter que ceder em outra, então a maioria dos modelos de embedding só tem desempenho competitivo para um tipo de tarefa. Mas os modelos <code>jina-embeddings-v5-text</code> são capazes de se especializar em todas as quatro áreas sem comprometer o desempenho, treinando <a href="https://arxiv.org/abs/2106.09685">adaptadores compactos de Low-Rank Adaptation (LoRA)</a> específicos para cada tarefa.</p><p>Adaptadores LoRA são uma espécie de plugin para um modelo de IA que muda o comportamento, aumentando ligeiramente o tamanho total. Em vez de ter um modelo inteiro para cada tarefa, cada um com centenas de milhões de parâmetros, a família de modelos <code>jina-embeddings-v5-text</code> permite que você use um modelo com um adaptador compacto LoRA para cada tarefa. Isso economiza memória, espaço de armazenamento e custos de inferência.</p><h3>Truncando embeddings</h3><p>Treinamos os modelos <code>jina-embeddings-v5-text</code> usando o <a href="https://arxiv.org/abs/2205.13147">Aprendizado de representação Matryoshka</a>, que permite reduzir seus embeddings para tamanhos menores com um custo mínimo para a qualidade deles.</p><p>Por padrão, <code>jina-embeddings-v5-text-small</code> gera vetores de embedding de 1024 dimensões, cada um representado por um número de 16 bits, fazendo com que cada embedding tenha 2KB de tamanho. Para um grande conjunto de documentos, isso pode representar uma grande quantidade de dados para armazenar, e a busca em um banco de dados vetorial repleto de embeddings é proporcional tanto ao tamanho do banco de dados quanto ao número de dimensões que cada vetor armazenado possui.</p><p>Mas você pode reduzir pela metade o tamanho dos embeddings (descartar 512 das 1024 dimensões) e ocupar metade do espaço enquanto dobra a velocidade das buscas. Isso tem um impacto no desempenho. Descartar informações reduz a precisão. Mas, como mostra o gráfico abaixo, mesmo ao eliminar metade do embedding, a redução de desempenho é mínima:</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt8deea6ee69a6b77d/6a17dbba0b0bed2217dd347e/f11969682c81bcf22b5b29a6204ba6ec40471b3d-900x700.png" alt="tamanho de embedding jina-embeddings-v5-text-small &amp; jina-embeddings-v5-text-nano" /><p>Desde que suas embeddings tenham pelo menos 256 dimensões, a perda de precisão deve permanecer relativamente pequena. Abaixo desse nível, porém, a relevância e a precisão se deterioram rapidamente.</p><p>Truncar embeddings como esse permite aos usuários gerenciar as próprias trocas entre precisão e custos computacionais. Ela oferece ferramentas para ter grandes ganhos de eficiência e grandes economias de custos com a IA de busca.</p><h3>Quantização robusta</h3><p><em>Quantização </em>é outra forma de reduzir o tamanho das embeddings. Em vez de descartar parte de cada incorporação, a quantização reduz a precisão dos números na embedding. Os modelos <code>jina-embeddings-v5-text</code> geram embeddings com números de 16 bits, mas podemos arredondar esses números, reduzindo a precisão e o número de bits necessários para armazená-los. No caso mais extremo, podemos reduzir cada número a um bit (0 ou 1), comprimindo as embeddings padrão de 1024 dimensões de <code>jina-embeddings-v5-text</code>de 2 kilobytes para 128 bytes, uma redução de 94% apenas com a quantização binária. Assim como para a truncagem, isso produz grandes economias em memória e custos computacionais. No entanto, assim como a truncagem, a quantização torna as embeddings menos precisas.</p><p>Treinamos os modelos <code>jina-embeddings-v5-text</code> para funcionar com a <a href="https://www.elastic.co/docs/reference/elasticsearch/mapping-reference/bbq">Better Binary Quantization (BBQ)</a> do <a href="https://www.elastic.co/pt/elasticsearch">Elasticsearch</a>, minimizando a perda de precisão. Os testes de benchmark de embeddings binarizados desses modelos mostram desempenho quase igual aos equivalentes não binarizados. Consulte <a href="https://arxiv.org/abs/2602.15547">o relatório técnico</a> para estudos detalhados de ablação sobre o desempenho da binarização.</p><h3>Desempenho multilíngue</h3><p>Muitos modelos de embedding são multilíngues porque foram treinados com materiais que incluem um grande número de linguagens. Mas isso não significa que todos tenham o mesmo desempenho em todas as linguagens disponíveis.</p><p>Identificamos 211 linguagens no benchmark multilíngue MMTEB e os separamos para que pudéssemos comparar nossos modelos com modelos semelhantes linguagem por linguagem. A imagem abaixo resume nossos resultados como um mapa de calor. Cada patch é uma linguagem (identificada pelo código ISO-639), e quanto mais verde ela é, melhor o modelo teve desempenho em comparação com a média de modelos similares:</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltee08033102f46c4f/6a17dbbc420229503229f4c8/852ac5d0f1977bb0c1124d87f8863a9bb94eb7da-1600x765.png" alt="As linguagens ina-embeddings-v5-text-nano e jina-embeddings-v5-text-small no benchmark multilíngue MMTEB" /><p>Embora a precisão varie entre as linguagens, os modelos <code>jina-embeddings-v5-text</code> são de ponta ou quase isso na maioria das linguagens do mundo.</p><p>Para saber detalhes sobre o desempenho multilíngue, consulte o <a href="https://arxiv.org/abs/2602.15547"><code>jina-embeddings-v5-text</code></a><a href="https://arxiv.org/abs/2602.15547"> relatório técnico</a>.</p><h2><strong>Jina no Elastic: IA nativa de última geração para busca</strong></h2><p>Com <code>jina-embeddings-v5-text</code> modelos no EIS, você pode executar modelos de embedding multilíngue de alto desempenho de forma nativa no <a href="https://www.elastic.co/pt/elasticsearch">Elasticsearch</a>, com inferência totalmente gerenciada e acelerada por GPU, sem infraestrutura para provisão ou redimensionamento. <code>jina-embeddings-v5-text</code> modelos ampliam o catálogo cada vez maior de modelos EIS com modelos compactos e multilíngues, impulsionados pelos mais recentes avanços em IA. Esses modelos têm desempenho de ponta em recuperação de informações e benchmarks padrão de análise de dados, além de oferecer suporte multilíngue incomparável e global.</p><p>Com dois modelos de tamanhos muito diferentes, os usuários podem definir qual é o mais adequado para as aplicações e orçamentos. Além disso, com embeddings robustas que mantêm o desempenho quando truncadas para tamanhos menores ou quantizadas com menor precisão, <code>jina-embeddings-v5-text </code>modelos oferecem oportunidades para economias concretas adicionais em custos de armazenamento e computação, bem como na latência de processamento.</p><p>Com a família <code>jina-embeddings-v5-text</code> , Jina Reranker e a busca vetorial rápida e BM25 da Elastic, os usuários agora têm acesso à <a href="https://www.elastic.co/docs/solutions/search/hybrid-search">busca híbrida</a> de ponta a ponta e de última geração da Elastic. Quando você precisa dos resultados mais relevantes, seja para pipelines de Retrieval-Augmented Generation (RAG), aplicações de busca ou análise de dados, a Elastic com modelos de IA de busca Jina oferece qualidade sólida e econômica.</p><h2><strong>Para começar</strong></h2><p>Os modelos <code>jina-embeddings-v5-text</code> estão totalmente integrados ao <a href="https://www.elastic.co/docs/explore-analyze/elastic-inference/eis">EIS</a> e você pode usá-los definindo o <strong><code>type</code></strong>campo para<strong><code>semantic_text</code></strong> ao criar seu índice e especificar o modelo (<code>jina-embeddings-v5-text-small</code> ou <code>jina-embeddings-v5-text-nano</code>) no <code>inference_id</code>campo, como neste exemplo:</p>PUT multilingual-semantic-index
{
  "mappings": {
    "properties": {
      "content": {
        "type": "semantic_text",
        "inference_id": ".jina-embeddings-v5-text-small"
      }
    }
  }
}

# Ingest data about France
POST multilingual-semantic-index/_doc
{
  "content": "The capital of France is Paris"}

GET multilingual-semantic-index/_search
{
  "query": {
    "semantic": {
      "field": "content",
      "query": "What is the French capital?"
    }
  }
}<p>O <a href="https://www.elastic.co/pt/elasticsearch">Elasticsearch</a> seleciona automaticamente o adaptador LoRA apropriado durante a indexação e a recuperação. As dimensões de embedding (veja a seção "<strong>Truncando embeddings</strong> ", acima) podem ser definidas ao <a href="https://www.elastic.co/docs/api/doc/elasticsearch/operation/operation-inference-put">criar um endpoint de inferência personalizado</a>.</p><p>Consulte a <a href="https://www.elastic.co/docs/reference/elasticsearch/mapping-reference/dense-vector">documentação do Elasticsearch</a> para saber mais informações sobre como usar os modelos <strong><code>jina-embeddings-v5-text</code></strong> .</p><h2><strong>Mais informações</strong></h2><p>Para saber mais sobre os modelos <code>jina-embeddings-v5-text</code> , leia as <a href="https://jina.ai/news/jina-embeddings-v5-text-distilling-4b-quality-into-sub-1b-multilingual-embeddings/">notas de lançamento no blog da Jina AI</a> e o <a href="https://arxiv.org/abs/2602.15547">relatório técnico</a>, que contém informações técnicas mais detalhadas sobre o desempenho e o novo procedimento de treinamento inovador da Jina AI. Para saber informações sobre como fazer download e executar esses modelos de forma local, acesse a<a href="https://huggingface.co/collections/jinaai/jina-embeddings-v5-text"> página da coleção</a> <a href="https://huggingface.co/collections/jinaai/jina-embeddings-v5-text"><code>jina-embeddings-v5-text</code></a>na Hugging Face.</p><p>Os modelos de Jina AI estão disponíveis sob a <a href="https://spdx.org/licenses/CC-BY-NC-4.0">licença CC-BY-NC-4.0</a>, portanto, você pode baixá-los e experimentá-los de forma livre, mas para uso comercial, entre em contato com a <a href="https://www.elastic.co/contact?pg=global&amp;plcmt=nav&amp;cta=205352">equipe de vendas da Elastic</a>.</p>]]></content:encoded>
    <link>https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text</link>
    <guid isPermaLink="true">https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text</guid>
    <category><![CDATA[Jina AI]]></category>
    <dc:creator><![CDATA[Scott Martens,Sofia Vasileva]]></dc:creator>
    <enclosure url="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/bltfd81be89ffe5b036/6a17dbbd445de9b55e4cffd1/e98dd30ab925b4bb32830228d71a1a51d02a0917-1600x840.png" length="0" type="image/png"/>
    <pubDate>Mon, 23 Feb 2026 00:00:00 GMT</pubDate>
  </item>
  </channel>
</rss>