Sucheinstellungen am Datenpool

Berechtigungen aus der Quelle, Textstellen pro Antwort, Freigabestufe und Schlafmodus — was sich einstellen lässt, was sich selbst regelt und wie Du mit „Ausprobieren" prüfst, was gefunden wird

Was sich einstellen lässt

EinstellungGilt fürWoStandardWas sie tut
Berechtigungen aus der QuelleSharePoint-Quellen in der CloudEinstellungen → Datenquellen, für den ganzen WorkspaceausJede Person findet nur die Dateien, die sie in SharePoint selbst öffnen darf
Textstellen pro AntwortOutpostDatenquelle → Übersicht → Einstellungen10 (1–100)Obergrenze der Fundstellen, die in eine Antwort einfließen
FreigabestufeOutpostin der Outpost-App; die Seite zeigt sie nur anNur TextWas aus dem Ordner herausgeht: Text oder zusätzlich die Originaldatei
GlossarCloudEinstellungen → Datenquellen → Schaltfläche Glossar, für den ganzen WorkspaceleerWörter, die dasselbe bedeuten; die Suche sucht alle, siehe Glossar
Maßgeblich / VeraltetCloudDatenquelle → Wissenslandkarte oder Dateien, je DateikeineZieht eine Datei leicht vor oder stellt sie zurück und kennzeichnet sie als veraltet, siehe Markierungen

Eine Cloud-Datenquelle hat keine Freigabestufe: Wer sie nutzen darf, bekommt Volltext, Originaldatei und Bilder — außer bei Quellen, die früher auf Nur Textausschnitte oder Nur Text eingeschränkt wurden, siehe Quellenangaben in Antworten. Mehr dazu: Freigabestufe.

Bei Cloud-Datenquellen entscheidest Du, was angebunden ist und wer es nutzen darf. Wie gesucht wird, regelt MeinGPT selbst: Stichwort- und Bedeutungssuche laufen immer beide, Bilder werden gelesen, wo es das Format erlaubt, und selten genutzte Quellen gehen von allein in den Schlafmodus und wieder heraus. Antworten zeigen immer ihre Quellen; das lässt sich nicht abschalten.

Berechtigungen aus der Quelle

Unter Einstellungen → Datenquellen legst Du für den ganzen Workspace fest, ob die Suche in SharePoint-Quellen die Berechtigungen aus SharePoint übernimmt:

  • An: Jede Person findet in einer SharePoint-Quelle nur die Dateien, die sie in SharePoint selbst öffnen darf — auch Admins. Wer sich nie mit Microsoft bei MeinGPT angemeldet hat, findet in diesen Quellen nichts. Sind die Berechtigungen gerade nicht aktuell, liefert die Quelle keine Treffer, statt zu viel zu zeigen. Den Stand siehst Du an der Datenquelle unter Einstellungen → Berechtigungen.
  • Aus: Jede Person mit Zugriff auf eine Datenquelle findet jede Datei darin.

Standardmäßig ist die Einstellung aus. Weil sich damit ändert, wer was findet, fragt die Seite vor dem Umschalten nach; jede Änderung steht im Audit-Log. Steht an der Einstellung „Noch nicht aktiv", ist die Übernahme in Deiner Umgebung noch nicht freigeschaltet: Bis dahin findet jede Person mit Zugriff auf eine Quelle jede Datei darin, auch wenn die Einstellung an ist.

Hinweis

Gilt derzeit für SharePoint. Für Google Drive, Confluence und andere Quellen werden Berechtigungen noch nicht übernommen: Dort findet jede Person mit Zugriff auf die Datenquelle alles darin.

Schlafmodus

Eine Cloud-Datenquelle, die 60 Tage lang niemand durchsucht hat, geht in den Schlafmodus. Du erkennst das am Hinweis „Schlafmodus" in der Liste der Datenquellen. Einstellen musst und kannst Du dafür nichts.

Hinweis

Wird schrittweise eingeführt. Der Schlafmodus ist noch nicht in jeder Umgebung aktiv. Solange er es in Deiner nicht ist, schläft keine Quelle neu ein. Eine Quelle, die schon schläft, bleibt im Schlafmodus, bis eine Suche sie aufweckt.

  • Die Stichwortsuche funktioniert weiter. Assistenten und Chats finden alles, was dieselben Wörter enthält; nur die Bedeutungssuche pausiert, und neue Dateien werden nicht eingebettet.
  • Die nächste Suche baut die Quelle automatisch wieder auf — egal ob im Chat, in der Suche (Cmd+K) oder mit Ausprobieren. Sie liefert sofort Stichworttreffer und sagt dazu, dass die Quelle gerade wieder aufgebaut wird; die Bedeutungssuche ist nach kurzer Zeit wieder da. Solange sie aufgebaut wird, steht an der Quelle „Wird wieder aufgebaut …".

Im Schlafmodus wird nichts gelöscht.

Textstellen pro Antwort

Der Wert legt fest, wie viele Fundstellen aus einer Outpost-Datenquelle höchstens in eine Antwort einfließen. Möglich sind 1 bis 100, der Standard ist 10. Bei Cloud-Datenquellen wählt der Assistent die Anzahl pro Suche selbst; ein fester Wert würde dort nicht ausgewertet und wird deshalb nicht angezeigt.

Starte mit 10. Erhöhe den Wert in kleinen Schritten, wenn Antworten inhaltlich abbrechen — etwa in langen Betriebsanleitungen mit Tabellen —, und prüfe jede Änderung mit Ausprobieren. Mehr Textstellen machen die Antwort langsamer und belegen Platz im Kontextfenster des Modells; bei genügend hohem Wert kann das zu einem „Chat zu groß"-Fehler führen. Mehr dazu: Chat zu groß für das Modell.

Der eigentliche Hebel: Ausprobieren

Wenn Du die Qualität einer Datenquelle beurteilen willst, ist Ausprobieren aussagekräftiger als jede Einstellung. Du findest es in der Datenquelle im Tab Übersicht.

Dort stellst Du echte Fragen an die Quelle — auf demselben Weg, den auch Assistenten nutzen. Jeder Treffer zeigt Datei und Textstelle; unter Wie gefunden? siehst Du, ob er über die Stichwortsuche, die Bedeutungssuche oder beide kam, welchen Rang er hatte und aus welchem Abschnitt und welcher Seite er stammt.

Als Person suchen. Statt als Du selbst kannst Du auch als eine Kollegin oder ein Kollege suchen. Das prüft, ob diese Person die Quelle nutzen darf, und zeigt, was sie darin findet. Hat die Person keinen Zugriff auf die Quelle, bekommst Du keine Treffer, sondern den Grund — etwa, dass sie in keinem der freigegebenen Teams ist. Jede Suche als andere Person wird im Audit-Log vermerkt, ohne den Suchtext.

Hinweis

Berechtigungen je Dokument gelten nur in zwei Fällen: in SharePoint-Quellen mit eingeschalteten Berechtigungen aus der Quelle und in Outpost-Ordnern mit Windows-Rechten. Dort zeigt „Als Person suchen" den Stand der Berechtigungen dieser Person, nicht ihre Treffer. In allen anderen Quellen findet, wer die Datenquelle nutzen darf, alles darin; „Als Person suchen" prüft dann den Zugriff auf die Quelle.

Vorgehen, das sich bewährt hat: Sammle fünf bis zehn Fragen, die Deine Kolleg:innen tatsächlich stellen würden, und gehe sie in Ausprobieren durch. Findest Du zu einer Frage kein passendes Dokument, liegt das fast immer am Zuschnitt der Quelle oder an einem Dokument, das nicht im Index ist — und nicht an einer Einstellung. Ob eine bestimmte Datei durchsuchbar ist und warum nicht, zeigt der Tab Dateien. Wie Du den Zuschnitt verbesserst: Daten gezielt eingrenzen.

Was nicht einstellbar ist

Einige Werte der Suche sind fest vorgegeben und erscheinen bewusst nicht in der Oberfläche:

  • Wie viele Textstellen in eine Antwort einfließen — bei Cloud-Datenquellen. Das wählt der Assistent pro Suche.
  • Wie gründlich gesucht wird. Der Assistent stellt bei Bedarf selbst mehrere Suchanfragen hintereinander und liest ganze Dateien nach; einen eigenen Schalter dafür gibt es nicht.
  • Ob Quellenangaben erscheinen. Jede Antwort aus einer Datenquelle nennt ihre Quellen.
  • Ob die Bedeutungssuche läuft. Sie ist für jede Cloud-Datenquelle an; nur der Assistent kann eine einzelne Suche auf ein Verfahren beschränken.
  • Ob Bilder gelesen werden. Wo das Format es erlaubt, immer.
  • Wann eine Quelle schläft und aufwacht. Siehe Schlafmodus.
  • Das Mischungsverhältnis zwischen Bedeutungssuche und Stichwortsuche.
  • Der Mindest-Relevanzwert, unterhalb dessen ein Treffer verworfen wird.
  • Eine zweite Relevanzprüfung (Reranking). Die Plattform sortiert die Treffer nicht noch einmal mit einem eigenen Modell um.
  • Die Wahl des Suchverfahrens. Die Plattform entscheidet das pro Anfrage automatisch.

Diese Werte sind über Bestände hinweg abgestimmt; einzeln verstellbar bringen sie mehr Fehlkonfiguration als Nutzen.

Verwandte Seiten

War diese Seite hilfreich?