Ich habe eine Signaturengruppe „Soziologie“, die sehr allgemein gehalten ist und dank mechanischer Aufstellung mittlerweile ~9000 Bände enthält. Da die größtenteils im Lesesaal steht und fünstellige Nummern gar nicht mehr komplett auf einen Buchrücken passen würden, haben wir überlegt die Signatur thematisch aufzuspalten.
Ich würde gerne:
die Verschlagwortung aller Titel in der Signaturengruppe abrufen und
Cluster bilden um mich inspirieren zu lassen, wie sich die große Gruppe aufteilen lassen könnte
Aber da liegen zu viele einzelne Arbeitsschritte dazwischen. Ich wüsste nicht einmal wie ich, selbst wenn ich mit der Excel-Tabelle erstellen Funktion der WinIBW (GBV) z.B. nur die BK abrufen würde, so es sie gibt, diese abgerufenen BKs zusammenfassen und zählen könnte.
Wie würdet ihr vorgehen (mein Vorwissen ist sehr gering)? Sorry.
Hi,
auch wenn ich es noch nicht ganz verstehe, würde ich denken, dass du mit OpenRefine sehr weit kommen würdest.
Voraussetzung ist allerdings, dass du die Daten als Tabelle aus dem System bekommst. Bist du bei diesem Schritt schon?
Hallo, zum Gruppieren kann man Power Query innerhalb von Excel ganz gut nutzen. Ich nutze die WinIBW nur für ZDB-Exporte. Für das Erstellen der Excel-Datei gibt es diese Anleitung: Excel-Tabelle erstellen - K10plus - Startseite . Ansonsten verstehe ich auch noch nicht so ganz dein Problem und was ist BK?
Die Tabelle, die ich aus dem System bekomme sieht so aus. Es ist nur das Feld Basisklassifikation (BK) ausgegeben. PPN (Standardnummer für einen Datensatz) und EPN (Standardnummer für ein Exemplar) kommt immer mit. Wenn mehr als eine BK angegeben ist werden die BKs mit Semikolon ( getrennt. Ich habe hier schonmal die einzelnen BK in einzelne Spalten geschoben.
Da steht jetzt z.B. in irgendeiner der Spalten (die Anzahl der vergebenen BK schwankt zwischen 0 und 6+ pro Titel) „71.68$jSozial Schwache“ (das sehe ich in dem Screenshot jetzt 3x) und dann möchte ich alle Nennungen zusammenzählen lassen. Insgesamt sind es natürlich wesentlich mehr Zeilen sonst würde ich ein Blatt Papier nehmen und Striche machen. Und dann habe ich am Ende die Häufigkeit in der BKs in der Signaturengruppe auftauchen. Und damit hoffe ich erkennen zu können in welche großen Bereiche sich der Bestand aufteilt um eine Idee zu bekommen wie ich die Bände aus dieser einen großen Gruppe aufteilen kann in kleinere Signaturengruppen. Hilft das beim Verständnis?
Und dasselbe möchte ich dann noch mit einer Tabelle machen in der ich die vergebenen Schlagwörter abgefragt habe.
Hallo, wenn du mir die Tabelle an diese Adresse schickst kai.hessling@posteo.de, kann ich versuchen, das zu lösen. Jeden einzelnen Schritt zu erklären, würde vermutlich zu lange dauern
Danke. Das ist ein tolles Angebot. Aber ich muss es ja selbst lernen. Kann dir ja nicht mindestens noch eine andere Tabelle schicken in der du dasselbe nochmal mit anderen Werten machen müsstest.
Habe jetzt die Spalten EPN/PPN gelöscht (wir benutzen hier Excel )
Die einzelnen Spalten (jeweils nur die Spalte) nach A-Z sortiert.
Die Inhalte der sortierten Spalten untereinander in eine einzige Spalte copypasted und nochmal nach A-Z sortiert.
EDIT: Dann werde ich zukünftig diese Spalte markieren, STRG+H drücken und ein Leerzeichen suchen (also in dem Feld Suchen auf die Leertaste drücken) und mit nichts (ins Feld Ersetzen durch kommt nichts) Alle Ersetzen. Und danach nochmal von A-Z sortieren.
Dann in der Spalte neben der ersten Zeile die Formel =ZÄHLENWENN(C1:C8156;C1:C8156) … C1 ist die erste Zeile mit Wert, C8156 war die letzte … eingegeben.
Dadurch hat Excel dann hinter jeden Eintrag C1 - C8156 die Gesamtzahl geschrieben wie oft der Eintrag auftaucht.
Diese Spalte habe ich dann kopiert und als Zahlenwerte ohne Formel nochmal eingefügt.
Dann habe ich die Spalte mit den Zahlen und die Spalte mit den BKs in ein neues Tabellenblatt kopiert
Und dort in der Spalte mit den Mengen nach Größe absteigend sortiert
Dann habe ich unter Daten → Duplikate entfernen im Menü die Spalte mit den Mengen ausgewählt und jetzt sieht es so aus (Auschnitt):
Wenn ich das dann mit einer vollständigen Liste nochmal mache versuche ich darauf zu achten, dass ich keine unnötigen Leerzeichen vor den BKs habe (ist bestimmt schon beim Trennen in Spalten passiert).
Aber ich glaube wirklich fest daran, dass so etwas eigentlich einfacher gehen müsste.
Hast Du eigentlich irgendwo die Möglichkeit python auszuführen? Dann wären es ungefähr 4 Zeilen, die ich Dir schicken könnte, mit Erklärung.
Ich hab sowas im Prinzip schon fertig, weil ich auch ständig vor genau dieser Sache stehe. String der gesplitet werden muss, plus Aufteilen auf Zeilen, plus Zählen.
Edit: In Excel stell ich es mir als kleine Hölle vor, aber Excel ist eigentlich immer eine kleine Hölle…
gern! Was man noch braucht ist pandas zu python dazu
import pandas as pd #aktiviert die pandas-Bibliothek
df = pd.read_excel('Name_der_Datei.xlsx') #eingabe des Dateinamens
df['Basisklassifikation'] = df['Basisklassifikation'].str.split('*hier das Trennzeichen eingeben, z. B. Komma*') #diese Zeile macht aus dem String aller Klassifikationen eine Liste, die man für den nächsten Schritt braucht
df = df.explode('Basisklassifikation') # hier werden für alle BKL eignen Zeilen gebildete
df['Basisklassifikation'] = df['Basisklassifikation'].str.strip() # löscht eventuell vorhandene Leerzeichen am Anfang und Ende
df = df.groupby(['Basisklassifikation']).size() #zählt das Vorkommen der Klassifikationen
df.to_csv('Ergebnis.csv')