Nextise Workflows
Recurring processes run automatically according to your business logic.
Retrieval-Augmented Generation, kurz RAG, verbindet ein Sprachmodell mit einer durchsuchbaren Wissensbasis. Vor jeder Antwort sucht das System passende Textstellen aus freigegebenen Dokumenten und übergibt sie dem Modell als Kontext, sodass Antworten auf echtem Firmenwissen statt nur auf Trainingsdaten beruhen.
RAG ist der Grund, warum ein KI-Assistent die eigenen Preislisten, Verträge oder Serviceberichte kennen kann, ohne dass das zugrunde liegende Sprachmodell darauf trainiert wurde.
Recurring processes run automatically according to your business logic.
Workshops & training so your team can use AI independently.
Analysis and architecture for situations beyond the standard case.
Custom CRM and mobile apps, connected to your knowledge base.
Your company knowledge instantly available for every employee.
Der entscheidende Unterschied liegt nicht darin, dass das Modell mehr weiß — es erhält für die konkrete Frage die richtigen Unterlagen.
Ein allgemeines Sprachmodell hat beim Training große Mengen öffentlich zugänglicher Texte verarbeitet und kann dadurch Sprache überzeugend formulieren. Ihre aktuellen Arbeitsanweisungen, Produktdaten oder Serviceberichte waren jedoch in aller Regel kein Teil dieses Trainings.
Genau hier entsteht im Unternehmen eine Lücke: Das Modell versteht die Frage, besitzt aber nicht die Information für eine belastbare Antwort. Gibt es trotzdem eine Antwort, kann sie sprachlich sicher wirken und sachlich falsch sein. RAG schließt diese Lücke, indem es die benötigten Informationen unmittelbar vor der Antwort bereitstellt.
Ein leistungsfähiges Modell kann schlechte Suchergebnisse nicht zuverlässig reparieren. Entscheidend sind Quellenqualität (aktuell, widerspruchsfrei, freigegeben), eine saubere Dokumentaufteilung und ein Suchverfahren, das auch Artikelnummern und Fachbegriffe findet.
Ebenso wichtig: Zugriffsrechte müssen bereits bei der Suche berücksichtigt werden, und jede Antwort sollte nachvollziehbare Quellenverweise zeigen, die sich gegen den Originaltext prüfen lassen.
RAG ist keine Wahrheitsmaschine. Wird ein falsches oder veraltetes Dokument gefunden, kann die Antwort ebenfalls falsch sein; werden relevante Stellen nicht gefunden, fehlt dem Modell die entscheidende Information.
Deshalb braucht ein produktives System Tests mit echten Fragen, messbare Qualitätskriterien und einen klaren Umgang mit Unsicherheit — bei sicherheitskritischen oder rechtlichen Fragen bleibt eine fachliche Prüfung erforderlich.
PDFs, Wiki-Seiten oder Handbücher werden eingelesen, in Abschnitte geteilt und mit Metadaten wie Titel oder Zugriffsrecht versehen.
Ein Embedding bildet jeden Abschnitt so ab, dass ähnliche Bedeutungen im Suchraum nahe beieinanderliegen, auch bei unterschiedlichen Formulierungen.
Bei einer Frage sucht das System die inhaltlich passendsten Abschnitte, gefiltert nach Freigabe und Zuständigkeit.
Das Sprachmodell erhält die Frage zusammen mit den gefundenen Textstellen und formuliert eine Antwort mit Quellenverweis.
Patrick Lewis et al., "Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks", 2020, https://arxiv.org/abs/2005.11401
We’ll help you find the next concrete step for your company.
Next step
Nextise guides you from the first analysis to a productive solution. Ready to deploy in 6–10 weeks.

