<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0">
  <channel>
    <title><![CDATA[Dustin Coates - Elasticsearch Labs]]></title>
    <description><![CDATA[Articles and tutorials from the Search team at Elastic]]></description>
    <copyright><![CDATA[© 2026. Elasticsearch B.V. All Rights Reserved]]></copyright>
    <image>
      <title><![CDATA[Dustin Coates - Elasticsearch Labs]]></title>
      <url>https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt1121c0bf0e8a6e65/6a88da6340a1841030ef456f/search-labs-thumbnail.png</url>
      <link>https://www.elastic.co/de/search-labs/author/dustin-coates</link>
    </image>
    <link>https://www.elastic.co/de/search-labs/author/dustin-coates</link>
    <atom:link href="https://www.elastic.co/de/search-labs/rss/author/dustin-coates.xml" rel="self" type="application/rss+xml"/>
    <language><![CDATA[de]]></language>
    <lastBuildDate>Fri, 11 Sep 2026 14:57:19 GMT</lastBuildDate>
  <item>
    <title><![CDATA[Elasticsearch-Vektordatenbank: In Minuten bereitstellen, kostengünstig auf Hunderte Milliarden skalieren]]></title>
    <description><![CDATA[Die schwierigen Aspekte des hybriden Abrufs, bereits erledigt – mit optimierten Standardeinstellungen, Drittanbieter- und nativen Jina AI-Modellen sowie verwalteter GPU-Inferenz, alles sofort einsatzbereit. Erstellen Sie schnelle, skalierbare KI-Apps, keine Infrastruktur.]]></description>
    <content:encoded><![CDATA[<p>Elasticsearch ist eine der weltweit am weitesten verbreiteten Plattformen für Vektor-Workloads und unterstützt semantische Suche, Retrieval-Augmented Generation (RAG) sowie Empfehlungen für Unternehmen wie GitHub, Docusign, Seismic und viele andere. Heute kündigen wir die Elasticsearch-Vektordatenbank an – ein neues serverloses Angebot, das für vektorbasierte Anwendungen optimiert wurde. Sie bringen Ihre Dokumente und Ihre Abfragen mit, und wir kümmern uns um die Einbettungen, das Index-Tuning sowie die Infrastruktur. Und wir halten es kostengünstig und skalierbar. </p><p>Für neue Nutzer ist dies der schnellste Weg, eine hochwertige Vektorsuche in Betrieb zu nehmen. Wenn Sie Elasticsearch bereits nutzen, bietet das neue Angebot eine Vektorsuche auf der Plattform, auf der Ihre Daten bereits gespeichert sind – ganz ohne die Einführung eines neuen Systems. Die Elasticsearch-Vektordatenbank unterstützt verschiedene Szenarien – vom Grounding eines großen Sprachmodells (LLM) über die Bereitstellung von Abruf- und Speicherfunktionen für KI-Agenten bis hin zur Bereitstellung von Hunderten Milliarden Vektoren. <a href="https://cloud.elastic.co/registration?onboarding_token=vector">Starten Sie ein neues Projekt</a> und legen Sie in wenigen Minuten los.</p><h2>Eine Engine für alle Vektor-Anwendungsfälle</h2><p>Die Elasticsearch-Vektordatenbank wurde für alle entwickelt, die Anwendungen mit Vektoren erstellen:</p><ul><li><p><strong>RAG:</strong> Rufen Sie mit dem Abruf dichter und dünnbesetzter Vektoren den passenden Kontext für Ihr LLM ab oder entscheiden Sie sich für die Hybridsuche, die sowohl den Vektor- als auch den lexikalischen Abruf kombiniert. Die Qualität Ihrer Generierung verbessert sich mit der Qualität Ihres Abrufs.</p></li><li><p><strong>KI-Agenten:</strong> Geben Sie Agenten schnellen, gefilterten Zugriff auf Dokumente und Konversationsgedächtnis – mit den niedrigen Latenzen, die mehrstufige Agentenschleifen erfordern.</p></li><li><p><strong>Semantische Suche:</strong> Gleichen Sie nach Bedeutung statt nach Schlagwörtern ab – mit einem einzigen Feldtyp und ganz ohne Pipeline-Code.</p></li><li><p><strong>Empfehlungen und Ähnlichkeit:</strong> Finden Sie die nächsten Nachbarn über Produkte, Bilder oder beliebige andere Inhalte hinweg – und das in großem Maßstab.</p></li></ul><h2>Alles, was Ihre Vektor-Workloads benötigen – standardmäßig optimiert</h2><p>Eine vektorbasierte Anwendung zu erstellen bedeutet, mehrere separate Komponenten miteinander zu verbinden: Einbettungsmodelle einzurichten und zu hosten, Ihre Dokumente damit zu indexieren, die Vektoren effizient zu speichern, das Einbettungsmodell auf jede Abfrage anzuwenden, mit dem Vektorspeicher abzugleichen und schließlich die Dokumente hinter den Treffern abzurufen. Die Elasticsearch-Vektordatenbank übernimmt all das für Sie – ohne zusätzliche Konfiguration oder Einrichtung.</p><h3>Vektorindexierung mit vectordb_document-Indexmodus</h3><p>Der <a href="https://www.elastic.co/de/docs/reference/elasticsearch/mapping-reference/dense-vector#dense-vector-vectordb-document-mode">vectordb_document</a>-Indexmodus, eine neue Indexkonfiguration, die speziell für vektororientierte Workloads entwickelt wurde, ist standardmäßig aktiviert, sodass Sie die Einstellungen erhalten, die Experten wählen würden. Folgendes wird dadurch aktiviert:</p><ul><li><p><strong>Standardmäßig bfloat16:</strong> Vektoren werden mit der halben Größe von float32 bei vernachlässigbaren Auswirkungen auf den Recall gespeichert, wodurch sich Ihr Festplattenbedarf um etwa die Hälfte reduziert, noch bevor Quantisierung überhaupt ins Spiel kommt.</p></li><li><p><strong>Quellvektoren sind ausgeschlossen:</strong> In Elasticsearch befinden sich Ihre Einbettungen bereits in den Indexstrukturen, die für die Suche verwendet werden; eine zweite Rohkopie in _source würde lediglich den Speicher aufblähen und das Abrufen von Ergebnissen verlangsamen. Wir schließen das Duplikat aus, damit Antworten schneller zurückgegeben werden und Sie weniger speichern müssen.</p></li><li><p><strong>Die richtigen Dateien werden vorab in den Cache geladen:</strong> Die Datenstrukturen, auf die Vektorabfragen zuerst zugreifen, werden vorab in den Arbeitsspeicher geladen, sodass Ihre erste (und auch noch Ihre tausendste) Abfrage blitzschnell ist.</p></li><li><p><strong>Parallele Zusammenführung:</strong> Durch die Zusammenführung werden Segmente zu besser organisierten Vektorstrukturen konsolidiert, was sowohl den Recall als auch die Latenz verbessert, und durch die Multithread-Ausführung dieser Zusammenführungen erreichen Sie Ihr Ziel schneller.</p></li></ul><h3>Vektorspeicherung, Komprimierung und Auto-Tuning</h3><ul><li><p>Ihre Vektoren werden automatisch komprimiert.<a href="https://www.elastic.co/de/search-labs/blog/better-binary-quantization-lucene-elasticsearch"> Better Binary Quantization (BBQ)</a> reduziert den Vektorspeicherbedarf um das bis zu 32-Fache bei Beibehaltung der Trefferquote, und DiskBBQ verringert den Speicherbedarf für Workloads in großem Maßstab noch weiter.<a href="https://www.elastic.co/de/search-labs/blog/vector-quantization-auto-calibration-diskbbq"> </a></p></li><li><p>Entscheiden Sie sich für die<a href="https://www.elastic.co/de/search-labs/blog/vector-quantization-auto-calibration-diskbbq"> automatische Kalibrierung</a>, die die Quantisierung jedes Segments auf Ihre Daten abstimmt und bei jeder Zusammenführung neu abstimmt, wenn sich die Daten verändern. Bei Tests mit 18 Datensätzen verbesserten sich die Abfragen pro Sekunde (QPS) durchschnittlich um 16,7 %, wobei sich der Recall bei den meisten von ihnen erhöhte.</p></li></ul><h3>Einbettungen mit vollständig verwalteter GPU-Inferenz</h3><ul><li><p>Generieren Sie Einbettungen mit nativen <a href="https://www.elastic.co/de/jina-search-models">Embedding- und Reranking-Modellen von Jina AI</a> oder binden Sie Drittanbieter-Modelle ein – alles auf verwalteten GPUs über den <a href="https://www.elastic.co/de/docs/explore-analyze/elastic-inference/eis">Elastic Inference Service (EIS)</a> und ganz ohne eigene Modellserver. Oder hosten Sie selbst, wenn Sie eine eigene Lösung bevorzugen.</p></li><li><p>Der Feldtyp <a href="https://www.elastic.co/de/docs/reference/elasticsearch/mapping-reference/semantic-text"><strong>semantic_text</strong></a> verarbeitet Chunking und Einbettung sowie Abfragen automatisch – der einfachste Weg zur semantischen Suche auf dem Markt. </p></li></ul><h3>Hybridsuche und gefilterte Vektorsuche</h3><ul><li><p>Die <a href="https://www.elastic.co/de/elasticsearch/hybrid-search">Hybridsuche</a> ist integriert und kombiniert Volltext- und Vektor-Retrieval in einer einzigen Abfrage. Kombinieren Sie die Ergebnisse mit Reciprocal Rank Fusion (RRF) oder einem beliebigen anderen Mischmechanismus nach Ihren Wünschen. Die Vektorsuche ist meist der Teil der Hybridsuche, der sich am schwersten optimal konfigurieren lässt. Mit der Elasticsearch-Vektordatenbank haben Sie alles im Griff und Ihr gesamter Hybrid-Stack wird besser. </p></li><li><p>Mit der <a href="https://www.elastic.co/de/search-labs/blog/filtered-hnsw-knn-search">gefilterten Vektorsuche</a> wenden Sie Metadatenfilter als Teil des Vektorabrufs selbst an und nicht erst im Nachhinein, was den Recall beeinträchtigt.</p></li></ul><h3>Enterprise von Anfang an</h3><p>Sie erhalten außerdem rollenbasierte Zugriffssteuerung (RBAC), Audit Logging und die Compliance-Zertifizierungen, die reinen Vektordatenbanken in der Regel fehlen.</p><h2>Erschwinglich in großem Maßstab und vorhersehbar</h2><p>Die Elasticsearch-Vektordatenbank ist so konzipiert, dass sie auch bei wachsendem Bedarf erschwinglich bleibt: Durch BBQ- und DiskBBQ-Komprimierung, die das Speicherwachstum linear und den Arbeitsspeicherbedarf gering hält, führt die Skalierung auf Hunderte von Milliarden Vektoren nicht zu explodierenden Kosten. Und was Sie tatsächlich bezahlen, basiert auf Zahlen, die Sie bereits kennen: der Zahl der von Ihnen gespeicherten Daten, der Zahl der indexierten Daten und der von Ihnen benötigten Suchkapazität. Schätzen Sie Ihre Dokumentenzahl und die Vektordimensionen sowie Ihre Abfragelast ab, und Sie können bereits vor der Erstellung des Projekts ermitteln, was Sie zahlen werden. Außerdem können Sie Ihre Rechnung am Monatsende Zeile für Zeile nachvollziehen. Es gibt keine undurchsichtigen Recheneinheiten und keine überraschenden Gebühren für Hintergrundoperationen.</p><h2>Erste Schritte mit der Elasticsearch-Vektordatenbank</h2><h3>Ein Serverless-Vektordatenbank-Projekt erstellen</h3><p>Erstellen Sie ein neues <a href="https://cloud.elastic.co/registration?onboarding_token=vector">serverloses Vektordatenbank-Projekt in Elastic Cloud</a>. Leiten Sie Ihre Daten an den Endpoint weiter, und schon können Sie mit dem Indexieren beginnen.</p><img src="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt556cbdfba551f248/6aa10b4332b53038406d321a/image1.png" alt="Elastic Cloud Serverless project types: Elasticsearch, Vector Database, Observability and Security" /><h3>Einen Index mit semantic_text erstellen</h3><p>Der Vektorindex-Modus übernimmt die Vektorkonfiguration. Die Verwendung von semantic_text bedeutet, dass die Einrichtung von Einbettungen und Chunking sowie die Indexeinrichtung bei verwalteter GPU-Inferenz für Sie verwaltet werden, ohne dass Sie eine Einbettungs-Pipeline erstellen müssen.</p>PUT my-vectors
{
"mappings": {
"properties": {
"description": { "type": "semantic_text" }
    }
  }
}<h3>Dokumente ingestieren</h3><p>Indexieren Sie Text, und die Einbettungen werden für Sie generiert.</p>POST /my-vectors/_doc
{
  "id": "park_rocky-mountain",
  "title": "Rocky Mountain",
  "description": "Bisected north to south by the Continental Divide, this portion of the Rockies has ecosystems varying from over 150 riparian lakes to montane and subalpine forests to treeless alpine tundra."
}<h3>Eine semantische Suchabfrage ausführen</h3><p>Fragen Sie dasselbe semantische Feld ab, das Sie gerade erstellt haben:</p>GET /my-vectors/_search
{
  "query": {
    "semantic": {
      "field": "description",
      "query": "a mountain range in the middle of north america"
    }
  }
}<p>Und Sie erhalten Ergebnisse zurück:</p>{
  "took": 80,
  "hits": {
    "max_score": 0.7792325,
    "hits": [
      {
        "_index": "my-vectors",
        "_score": 0.7792325,
        "_source": {
          "id": "park_rocky-mountain",
          "title": "Rocky Mountain",
          "description": "Bisected north to south by the Continental Divide, ..."
        }
      }
    ]
  }
}<p>Die semantische Suche ist erst der Anfang. Führen Sie rein textbasierte Abfragen aus oder kombinieren Sie beides zu hybriden Abfragen. Sie können für die volle Kontrolle sogar Ihre eigenen Vektorabfragen erstellen. Folgen Sie dem <a href="https://www.elastic.co/de/docs/solutions/vector-database/vector-full-text-search">Schnellstart für die semantische Suche</a> in der Dokumentation zur vollständigen Anleitung.</p><h2>Was kommt als Nächstes für die Vektorsuche in Elasticsearch?</h2><p>Wir arbeiten bereits an den nächsten Verbesserungen:</p><ul><li><p><strong>Bessere Multi-Mandanten-Verwaltung:</strong> Wenn Ihre Daten pro Mandant getrennt bleiben müssen, bieten wir Ihnen eine Möglichkeit, dies schneller und mit weniger Code umzusetzen.</p></li><li><p><strong>Automatische Indexoptimierung:</strong> Vom „brandneuen Index“ bis zu „vollständig optimiert“, mit möglichst wenig Feinabstimmung.</p></li><li><p><strong>Kontinuierliche Infrastrukturverbesserungen:</strong> Eine laufende Optimierung der Einstellungen und Infrastruktur der Vektordatenbank, damit Sie stets den besten Durchsatz und die schnellsten Reaktionen erhalten.</p></li></ul><h2>Testen Sie die Elasticsearch-Vektordatenbank auf Elastic Cloud Serverless</h2><p>Gelangen Sie in wenigen Minuten von einem leeren Projekt zu einer hybriden, gefilterten Vektorabfrage – mit produktionsreifen Standardeinstellungen, die das Tuning für Sie übernehmen. Erstellen Sie schnelle, skalierbare KI-Apps, keine Infrastruktur.</p><p>Starten Sie auf <a href="https://cloud.elastic.co/registration?onboarding_token=vector">Elastic Cloud Serverless</a> oder tauchen Sie ein in die <a href="https://www.elastic.co/de/docs/solutions/vector-database">vollständige Dokumentation</a> und die <a href="https://www.elastic.co/de/docs/api/doc/elastic-cloud-serverless/group/endpoint-vectordb-projects">API-Referenz.</a></p>]]></content:encoded>
    <link>https://www.elastic.co/search-labs/blog/vector-database-rag-serverless</link>
    <guid isPermaLink="true">https://www.elastic.co/search-labs/blog/vector-database-rag-serverless</guid>
    <category><![CDATA[Vektordatenbank]]></category>
    <category><![CDATA[Elastic Cloud Serverless]]></category>
    <category><![CDATA[Hybride Suche]]></category>
    <dc:creator><![CDATA[Dustin Coates]]></dc:creator>
    <enclosure url="https://static-www.elastic.co/v3/assets/bltefdd0b53724fa2ce/blt4def84aae6aff861/6aa10ab1ee57e53d9b05253c/cover.png" length="0" type="image/png"/>
    <pubDate>Wed, 09 Sep 2026 00:00:00 GMT</pubDate>
  </item>
  </channel>
</rss>