Retrieval-Augmented Generation (RAG)

Beschleunigen Sie die Entwicklung generativer KI mit einem präzisen, flexiblen und kostengünstigen RAG-Dienst

Retrieval-Augmented Generation

Retrieval-Augmented Generation (RAG) ist eine Architektur, die die Fähigkeiten von KI-Modellen – einschließlich großer Sprachmodelle (LLMs) wie Qwen – erweitern kann. RAG ergänzt ein Information-Retrieval-System, das den Modellen relevante Kontextdaten bereitstellt, etwa domänenspezifische Daten oder die interne Wissensdatenbank eines Unternehmens, ohne dass das Modell neu trainiert werden muss. RAG verbessert die LLM-Ausgaben kostengünstig und macht die Ergebnisse relevanter und genauer.

Die Vektordatenbanken von Alibaba Cloud speichern, verwalten und abrufen Vektor-Embedding-Daten als hochdimensionale Daten effektiv und effizient – die ideale Wahl für das Information-Retrieval-System einer RAG-Architektur.

Watch Video

AnalyticDB for PostgreSQL

AnalyticDB for PostgreSQL ist ein Online-MPP-Datenwarehousing-Dienst (Massively Parallel Processing), der auf der Open-Source-Datenbank Greenplum basiert. Dank der MPP-Architektur bietet AnalyticDB for PostgreSQL auch Vektordatenbank-Funktionen, mit denen Sie Vektordaten speichern, analysieren und abrufen können. AnalyticDB for PostgreSQL wurde im OpenAI Cookbook als eine der empfohlenen Vektordatenbanken ausgewählt.

Mehr über die Vektordatenbank-Funktionen erfahren >
Mehr über den RAG-Dienst von AnalyticDB for PostgreSQL erfahren >
Erfahren Sie, wie Sie ein RAG-Plugin mit AnalyticDB for PostgreSQL erstellen >
Erfahren Sie, wie Sie AnalyticDB for PostgreSQL als Vektordatenbank im OpenAI Cookbook nutzen >

Produktdetails anzeigen

Alibaba Cloud Elasticsearch

Alibaba Cloud Elasticsearch bietet die doppelte Kosteneffizienz der Open-Source-Elasticsearch-Engine. Das leistungsstarke Toolkit ermöglicht es Ihnen, KI-gestützte Suchanwendungen zu erstellen, die nahtlos mit großen Sprachmodellen integriert sind. Profitieren Sie von hochleistungsfähiger semantischer Suche auch ohne exakte Keyword-Übereinstimmungen, Volltextantworten auf komplexe Fragen und personalisierten Empfehlungen. Zudem erhalten Unternehmen robuste Zugriffskontrolle, Sicherheitsüberwachung und automatische Updates.

Whitepaper „Der vollständige Leitfaden zu Alibaba Cloud Elasticsearch“ herunterladen >
Mehr über die neue KI-Suchlösung mit Elasticsearch erfahren >

Produktdetails anzeigen

Hologres

Hologres ist eine All-in-One-Echtzeit-Datenwarehouse-Engine, die mit PostgreSQL kompatibel ist. Sie unterstützt Online Analytical Processing (OLAP) und Ad-hoc-Analysen von Daten im PB-Bereich. Hologres ist tiefgreifend mit MaxCompute, Flink und DataWorks integriert und bietet eine Full-Stack-Datenwarehouse-Lösung, die Online- und Offline-Verarbeitung kombiniert. Zudem ist Hologres mit Platform for AI (PAI) integriert, und die integrierte Vektorsuchmaschine Proxima ermöglicht Echtzeitberechnungen von Merkmalsdaten sowie Echtzeit-Vektorabruf.

Mehr über „Vektorverarbeitung basierend auf Proxima“ erfahren >

Produktdetails anzeigen
Watch Video

OpenSearch

OpenSearch ist eine Alles-aus-einer-Hand-Plattform, die auf dem von Alibaba entwickelten groß angelegten verteilten Suchmaschinen-Framework basiert. OpenSearch Vector Search Edition ist für Vektorszenarien konzipiert und unterstützt Unternehmen beim Aufbau leistungsstarker, kostengünstiger und benutzerfreundlicher multimodaler Vektorsuchdienste für Text, Bilder, Audiodateien und Videos. OpenSearch bietet hohe Leistung und senkt Kosten, wenn Sie Vektorindizes für große Mengen unstrukturierter Daten erstellen und darauf basierend Daten abrufen.

LLM-basierte unternehmensspezifische Konversationssuche implementieren >
Multimodale Suche für E-Commerce implementieren >
Multimodale Suche für Bildung implementieren >

Produktdetails anzeigen

KI-gestützten RAG-Dienst mit Model Studio erstellen

Dieses Tutorial bietet eine Schritt-für-Schritt-Anleitung zum Einrichten eines RAG-Dienstes mit Alibaba Cloud Model Studio, Compute Nest und AnalyticDB for PostgreSQL. Mit Model Studio können Sie erstklassige generative KI-Modelle wie Qwen nutzen, um KI-Anwendungen mühelos zu entwickeln, bereitzustellen und zu verwalten. Diese Konfiguration gewährleistet eine sichere und effiziente Datenverarbeitung in Ihrem Unternehmen, erweitert die KI-Fähigkeiten und ermöglicht nahtlose natürlichsprachliche Abfragen.

Verwandte Ressourcen

Blog

Schnelle Erstellung eines RAG-Dienstes auf Compute Nest mit LLM auf PAI-EAS und AnalyticDB for PostgreSQL

Dieser Blog beschreibt, wie Sie mit Compute Nest einen RAG-Dienst erstellen – mit LLMs auf PAI-EAS und AnalyticDB for PostgreSQL als Vektordatenbank.

Blog

Die KI-Revolution entfachen – Eine Reise mit Qwen, RAG und LangChain

Dieser Blog beleuchtet den transformativen Weg der KI-Revolution und erklärt das Konzept von RAG und LangChain.

Blog

Konversationen der nächsten Stufe: LLM + VectorDB mit Alibaba Cloud ist anpassbar und kostengünstig

Dieser Blog erläutert die Vorteile von LLMs und Vektordatenbanken von Alibaba Cloud (mit Beispielen).