Nextise Workflows
Wiederkehrende Prozesse laufen automatisch nach Ihrer Geschäftslogik.
Retrieval-Augmented Generation, kurz RAG, verbindet ein Sprachmodell mit einer durchsuchbaren Wissensbasis. Vor jeder Antwort sucht das System passende Textstellen aus freigegebenen Dokumenten und übergibt sie dem Modell als Kontext, sodass Antworten auf echtem Firmenwissen statt nur auf Trainingsdaten beruhen.
RAG ist der Grund, warum ein KI-Assistent die eigenen Preislisten, Verträge oder Serviceberichte kennen kann, ohne dass das zugrunde liegende Sprachmodell darauf trainiert wurde.
Wiederkehrende Prozesse laufen automatisch nach Ihrer Geschäftslogik.
Workshops & Training, damit Ihr Team KI eigenständig nutzt.
Analyse und Architektur für Situationen jenseits des Standardfalls.
Individuelle CRM- und Mobile-Apps, verbunden mit Ihrer Wissensbasis.
Ihr Unternehmenswissen sofort abrufbar für jeden Mitarbeiter.
Der entscheidende Unterschied liegt nicht darin, dass das Modell mehr weiß — es erhält für die konkrete Frage die richtigen Unterlagen.
Ein allgemeines Sprachmodell hat beim Training große Mengen öffentlich zugänglicher Texte verarbeitet und kann dadurch Sprache überzeugend formulieren. Ihre aktuellen Arbeitsanweisungen, Produktdaten oder Serviceberichte waren jedoch in aller Regel kein Teil dieses Trainings.
Genau hier entsteht im Unternehmen eine Lücke: Das Modell versteht die Frage, besitzt aber nicht die Information für eine belastbare Antwort. Gibt es trotzdem eine Antwort, kann sie sprachlich sicher wirken und sachlich falsch sein. RAG schließt diese Lücke, indem es die benötigten Informationen unmittelbar vor der Antwort bereitstellt.
Ein leistungsfähiges Modell kann schlechte Suchergebnisse nicht zuverlässig reparieren. Entscheidend sind Quellenqualität (aktuell, widerspruchsfrei, freigegeben), eine saubere Dokumentaufteilung und ein Suchverfahren, das auch Artikelnummern und Fachbegriffe findet.
Ebenso wichtig: Zugriffsrechte müssen bereits bei der Suche berücksichtigt werden, und jede Antwort sollte nachvollziehbare Quellenverweise zeigen, die sich gegen den Originaltext prüfen lassen.
RAG ist keine Wahrheitsmaschine. Wird ein falsches oder veraltetes Dokument gefunden, kann die Antwort ebenfalls falsch sein; werden relevante Stellen nicht gefunden, fehlt dem Modell die entscheidende Information.
Deshalb braucht ein produktives System Tests mit echten Fragen, messbare Qualitätskriterien und einen klaren Umgang mit Unsicherheit — bei sicherheitskritischen oder rechtlichen Fragen bleibt eine fachliche Prüfung erforderlich.
PDFs, Wiki-Seiten oder Handbücher werden eingelesen, in Abschnitte geteilt und mit Metadaten wie Titel oder Zugriffsrecht versehen.
Ein Embedding bildet jeden Abschnitt so ab, dass ähnliche Bedeutungen im Suchraum nahe beieinanderliegen, auch bei unterschiedlichen Formulierungen.
Bei einer Frage sucht das System die inhaltlich passendsten Abschnitte, gefiltert nach Freigabe und Zuständigkeit.
Das Sprachmodell erhält die Frage zusammen mit den gefundenen Textstellen und formuliert eine Antwort mit Quellenverweis.
Patrick Lewis et al., "Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks", 2020, https://arxiv.org/abs/2005.11401
Wir helfen Ihnen, den nächsten konkreten Schritt für Ihr Unternehmen zu finden.
Nächster Schritt
Nextise begleitet Sie von der ersten Analyse bis zur produktiven Lösung. In 6–10 Wochen einsatzbereit.

