Verbindungsstatus prüfen, Sync-Fehler erkennen und beheben
Wie Du erkennst, ob ein Datenpool sauber synchronisiert, und was zu tun ist, wenn nicht. Setup und Konfiguration einer Datenquelle: Datenquellen & RAG.
Jede Datenquelle in der Liste der Datenquellen zeigt einen Status. Den genauen Grund nennt die Zeile darunter.
Status
Bedeutung
Aktuell
Alle Dateien sind eingelesen und durchsuchbar.
Durchsuchbar
Alle Dateien sind per Stichwort auffindbar, der Bedeutungsindex wird noch aufgebaut.
Wird eingelesen
Ein Abgleich läuft, wartet in der Warteschlange oder wird wiederholt.
Braucht Aufmerksamkeit
Etwas braucht eine Person, z. B. eine abgelaufene Anmeldung, eine nicht erreichbare Quelle oder ein Abgleich, der festhängt.
Pausiert
Die Datenquelle ist pausiert.
Unbekannt
Der Status lässt sich gerade nicht feststellen, z. B. weil ein Outpost keinen aktuellen Bericht geschickt hat.
Die Verbindung eines Outposts selbst siehst Du auf seiner Karte unter Einstellungen → Outposts. Ist er erreichbar, arbeitet aber nicht voll, steht dort Erreichbar · eingeschränkter Betrieb und darunter der Grund. Was jede Anzeige bedeutet: Verbindungsstatus eines Outposts.
Häufige Ursachen, wenn eine einzelne Datenquelle Braucht Aufmerksamkeit zeigt:
Der Zugriffstoken der Quelle (z. B. SharePoint, Google Drive, Confluence) ist abgelaufen oder wurde widerrufen
Berechtigungen im Quellsystem wurden entzogen
Netzwerk- oder Firewall-Änderungen auf Seiten des Quellsystems
Bei einer Outpost-Datenquelle spiegelt der Status die Erreichbarkeit aus Sicht von MeinGPT wider - das kann vom lokalen Indexierungsstand des Outposts abweichen. Zeigt die Outpost-Konsole den Ordner als vollständig indexiert, MeinGPT aber weiterhin "Braucht Aufmerksamkeit" oder "Unbekannt", prüfe die eigene Verbindungsanzeige des Outposts auf die zugrunde liegende Ursache.
Achtung
Zeigen alle Deiner Datenquellen gleichzeitig "Braucht Aufmerksamkeit" mit dem Grund "Quelle war nicht erreichbar" — auch solche mit völlig unterschiedlichen Quellsystemen (z. B. SharePoint, Google Drive und Confluence gleichzeitig) — deutet das in der Regel nicht auf ein Problem mit den einzelnen Quellen hin, sondern auf eine temporäre Störung auf Plattformseite. Wende Dich in diesem Fall an den MeinGPT-Support, statt einzelne Quellen neu zu verbinden.
Admins bekommen automatisch eine E-Mail, wenn es mit einem Daten-Pool ein Problem gibt:
Synchronisierung fehlgeschlagen – ein Daten-Pool ist mehrfach in Folge nicht synchronisiert. Neue oder geänderte Dokumente werden bis zur Behebung nicht indexiert.
Verbindung zur Datenquelle verloren – eine OAuth-Verbindung (z. B. SharePoint) kann ihren Zugriffstoken nicht mehr erneuern.
Viele Fehler bei der Synchronisierung – ein ungewöhnlich großer Anteil der Dateien einer Synchronisierung ist fehlgeschlagen.
Jede E-Mail verlinkt direkt auf die betroffene Datenquelle in den Einstellungen. Du kannst diese Benachrichtigungen unter Einstellungen → Benachrichtigungen → Datentresor-Benachrichtigungen einzeln ein- oder ausschalten.
Der Tab Synchronisierungsprotokolle hat zwei Unterreiter: Durchläufe zeigt die letzten Synchronisierungsläufe als Zahlen-Übersicht, Protokolle zeigt die Fehlermeldung zu jeder einzelnen Datei
Im Unterreiter Durchläufe hat jede Zeile drei Zahlenspalten:
Spalte
Bedeutung
Found
Wie viele Dateien dieser Lauf in der Quelle gefunden hat - die vollständige Auflistung des konfigurierten Bereichs, nicht nur neue oder geänderte Dateien
Ingested
Wie viele dieser gefundenen Dateien in diesem Lauf tatsächlich verarbeitet und in den Index übernommen wurden
Errored
Wie viele Dateien in diesem Lauf fehlgeschlagen sind
Hinweis
Diese drei Zahlen gelten nur für den jeweiligen Lauf, nicht kumulativ für den gesamten Daten-Pool - sie starten bei jedem neuen Sync-Lauf wieder bei 0. Zwei aufeinanderfolgende Läufe können deshalb sehr unterschiedliche Werte zeigen, ohne dass das auf einen Fehler hindeutet. Die Gesamtzahl aller aktuell indexierten Dateien findest Du stattdessen oben auf der Detailseite unter Indexierungsfortschritt.
Steht die Errored-Zahl über 0, wechsle in den Unterreiter Protokolle, filtere dort nach Status = error und öffne die betroffene Zeile - die Spalte Message enthält die konkrete Fehlermeldung zu genau dieser Datei, zum Beispiel einen Hinweis auf ein nicht verarbeitbares Metadatenfeld. Diese Meldung ist der Ausgangspunkt für die Fehlersuche; wende Dich mit dem genauen Wortlaut an support@meingpt.com, wenn daraus nicht klar wird, was zu tun ist.
Zeigt der aktuellste Lauf im Unterreiter Durchläufe bei allen drei Spalten 0 und wird der Lauf selbst trotzdem als fehlgeschlagen markiert - erkennbar an "Letzte Synchronisierung" oben auf der Detailseite mit dem Status „fehlgeschlagen" -, ist das ein anderer Fehlertyp als ein einzelner Dateifehler: Die erste Stufe ist fehlgeschlagen, bevor eine gefundene Datei für die weitere Verarbeitung sichtbar wurde. Meist konnte sie den Quellbereich gar nicht erst abfragen, aber auch ein späterer Fehler in derselben Stufe (etwa beim Herunterladen oder Ablegen des Gefundenen) erzeugt dasselbe Bild aus lauter Nullen. Der Unterreiter Protokolle bleibt in diesem Fall leer, weil es keine Datei gab, die hätte fehlschlagen können - das ist erwartet, kein zusätzliches Problem.
Typische Ursachen bei einer Cloud-Datenquelle wie SharePoint/OneDrive, Google Drive oder Confluence:
die konfigurierte Site, das Laufwerk oder der Ordner wurde in der Quelle verschoben, umbenannt oder gelöscht
die im Quellsystem hinterlegte Berechtigung wurde nachträglich auf diese eine Site oder Bibliothek eingeschränkt, obwohl die OAuth-Verbindung selbst weiterhin gültig ist
eine vorübergehende Störung oder Ratenbegrenzung beim Quellsystem
Prüfe zuerst, ob die verbundene Site/Bibliothek im Quellsystem noch unter derselben Adresse existiert und die Berechtigung dort weiterhin Zugriff auf genau diesen Bereich erlaubt - nicht nur allgemeinen Zugriff auf das Quellsystem. Hilft eine erneute Synchronisierung (siehe unten) nicht, wende Dich mit dem Namen der Datenquelle und dem Zeitpunkt des fehlgeschlagenen Laufs an support@meingpt.com - der genaue Fehlergrund des Laufs ist aktuell nicht auf der Detailseite sichtbar und muss vom Support nachgeschlagen werden.
Öffne den betroffenen Daten-Pool unter Einstellungen → Datenquellen
Klicke auf Synchronisieren, um sofort einen neuen Lauf zu starten
Bei jedem Sync-Lauf – egal ob automatisch oder manuell angestoßen – werden auch Einträge für Dateien entfernt, die in der verknüpften Quelle gelöscht wurden. Ein manueller Re-Sync ist daher der richtige Weg, um veraltete Indexeinträge loszuwerden, ohne die Datenquelle neu anlegen zu müssen. In seltenen Fällen kann eine einzelne Löschung beim Abgleich übersehen werden und bleibt dann auch nach einem erneuten Sync bestehen – wende Dich in diesem Fall an den MeinGPT-Support, damit wir uns die betroffene Datenquelle gezielt ansehen können.
Diese Meldung kann schon beim ersten Verbinden einer OAuth-Quelle erscheinen, bevor überhaupt ein Sync gelaufen ist - meist weil das Microsoft- oder Google-Anmeldefenster ohne gültigen Autorisierungscode geschlossen wurde. Bei SharePoint ist die häufigste Ursache eine fehlende Admin-Freigabe für die MeinGPT-Anwendung in Eurem Microsoft-Tenant; Details und weitere Ursachen: SharePoint/OneDrive-Fehlerbehebung.