Ganz verschiedenes, oft bezogen auf unsere Exemplardaten, da gab es über die letzten Jahre/Jahrzehnte diverse Einspielungen aus anderen Systemen und von Retrokatalogisierung, wo immer nochmal Fehler auftauchen.
Derzeit stöbere ich in einem Gesamtabzug unserer OPAC-Daten, die ich in KNIME direkt über die SRU-Schnittstelle gezogen habe (dann aber einmal als XML-Datei gespeichert und wieder eingelesen). Das sind ca. 73.000 Titeldatensätze. Über XPATH ziehe ich mir dann je nachdem, was ich mir gerade anschauen will, die relevanten Felder, die dann in der Ausgabe in Tabellenform angezeigt werden und weiterverarbeitet werden können. Hilfreich ist dort in der Anzeige manchmal der Blick in den Tab „Statistics“, wo ein paar Standard-Auswertungen automatisch angezeigt werden, z.B. „Missing values“ oder „Unique values“ pro Spalte. So ist z.B. aufgefallen, dass wir im OPAC noch einige Titeldaten ohne angehängte Exemplare haben („Missing values“ in der Spalte „EPN“). Das sind wohl Überbleibsel aus der Dublettenbereinigung im Zuge des Umstiegs auf K10Plus gewesen?
Ansonsten hatte ich einmal eine Liste der Systemstellen unserer Haussystematik eingelesen und unsere Signaturen dagegen gecheckt, um fälschlicherweise vergebene, nicht (mehr) offiziell vorhandene Systemstellen zu finden. Generell fehlerhafte oder ganz fehlende Signaturen konnten schnell gefunden werden.
Teilweise haben wir von einer Schriftenreihe sowohl Bände im Zeitschriftenbestand, als auch im Monografienbestand stehen, auch das konnte man recht schnell filtern.
Ich habe mir damit auch unseren Monografienbestand angeschaut und dessen Verteilung innerhalb unserer Systematik und das Alter des Bestandes analysiert (Durchschnittserscheinungsjahr pro Hauptgruppe, wo kam in den letzten Jahren viel neues dazu, wo schon ewig nicht mehr… alles was mir irgendwie interessant vorkam).
Generell benutze ich die Software sowohl zum allgemeinen Stöbern ohne konkreten Anlass, aber auch wenn im Alltag etwas auftaucht, wo man wissen möchte, ob das ein Einzelfall ist oder ein verbreitetes Problem, ist sie echt hilfreich. Im Prinzip kann man vieles davon theoretisch auch mit Excel machen, aber der riesige Vorteil bei diesen gebauten Workflows ist, dass man jederzeit zu jedem Punkt einfach zurückgehen und nochmal was ändern kann, oder z.B. mit einem neuen/aktualisierten Datenabzug alle Schritte mit einem Klick nochmal wieder anstoßen und durchlaufen lassen kann.
Die Lernkurve ist am Anfang recht steil, aber ich würde sagen, es ist trotzdem deutlich leichter, als sich komplett neu eine Programmiersprache anzueignen.
So, das war jetzt ein langer Text, aber vielleicht macht es das ein bisschen anschaulicher 