Jour fixe 2026-07-10: Unterschied zwischen den Versionen

Aus DIF Filmographie Wiki
Wechseln zu: Navigation, Suche
(Abgleich mit vorhandenen Relationen)
Zeile 29: Zeile 29:
 
Für die einzelnen Vokabulare sollte auf jeden Fall geprüft werden, wie die verwendeten Identifikatoren  
 
Für die einzelnen Vokabulare sollte auf jeden Fall geprüft werden, wie die verwendeten Identifikatoren  
 
derzeit in der ZDB-Relationentabelle aussehen. Eine Abfrage für die Agent-Relationen sähe beispielsweise so aus:
 
derzeit in der ZDB-Relationentabelle aussehen. Eine Abfrage für die Agent-Relationen sähe beispielsweise so aus:
<code>
 
 
   SELECT Rel, COUNT(Rel) As Anz FROM relation WHERE  
 
   SELECT Rel, COUNT(Rel) As Anz FROM relation WHERE  
 
     (((SubjEnt="P") AND (ObjEnt="P"))
 
     (((SubjEnt="P") AND (ObjEnt="P"))
Zeile 35: Zeile 34:
 
     OR ((SubjEnt="KS") AND (ObjEnt="KS"))
 
     OR ((SubjEnt="KS") AND (ObjEnt="KS"))
 
     OR ((SubjEnt="KS") AND (ObjEnt="KS")))
 
     OR ((SubjEnt="KS") AND (ObjEnt="KS")))
   GROUP BY Rel </code>
+
   GROUP BY Rel  
und für die Credit-Relationen so:
+
und für die Credit-Relationen so:  
<code>
 
 
   SELECT Rel, count(Rel) AS Anz FROM relation WHERE  
 
   SELECT Rel, count(Rel) AS Anz FROM relation WHERE  
 
     (SubjEnt="FW") AND ((ObjEnt="KS") OR (ObjEnt="P"))
 
     (SubjEnt="FW") AND ((ObjEnt="KS") OR (ObjEnt="P"))
   GROUP BY Rel ORDER BY Rel </code>
+
   GROUP BY Rel ORDER BY Rel
 +
 
 +
==== Identifikatoren für URIs ====
 +
 
 +
Tatsächlich können wir bei den RDF-Darstellungen durchgehend mit [https://www.rfc-editor.org/info/rfc3987/ IRIs] arbeiten, d.h. aufgelöste Umlaute ("Auffuehrung" statt "Auffphrung") sind nicht nötig. Im Identifikatoren-Teil müssen nur vorhandene Leerzeichen und einige Interpunktion (/, &, ", ?, : ) vermieden bzw. ersetzt werden.
 +
 
 +
''Frage:'' Wollen wir es beim derzeitigen Durcheinander belassen, oder eine einheitliche Verwendung von IRIs (also das Beseitigen von "ae", "oe" etc.) anstreben?

Version vom 9. Juli 2026, 05:58 Uhr

Eine Seite aus dem Reformhaus

Jour fixe, Freitag, 10. Juli 2026

Themenwüsche bitte hier notieren.

Doppelte WD-Identifier

Ist eine Dokumentation notwendig, wenn Personen mit zwei WD Identifiern zusammen gelegt werden? Bei der GND senden wir gesondert einen GND-Report, welche Nummer der Gewinner ist. momentan haben wir 8 Personen mit doppelten WD-Identifiern, ich schätze, in der Vergangenheit wurde die WD aus dem Verliererdatensatz gelöscht.

Kristina: wir können die Datensätze auch in Wikidata mergen, wenn es sich um Duplikate (vielleicht sogar durch uns produziert?) handelt: https://www.wikidata.org/wiki/Special:MergeItems


Relationenvokabular in RDF

Umsetzung Entwurf ZDB_V0-1

Gruppierungen: bei direkter Übernahme würden Kollisionen mit der "Notation" auftreten, nach der die Credit-Auswahl bei der Bearbeitung organisisert ist. Die Neugruppierung sollte deshalb erst vorgenommen werden, wenn das RDF-Vokabular in den Bearbeitungszyklus integriert ist. Kristina: könntest du das bitte kurz an einem Beispiel erklären? Ich verstehe das gerade noch nicht ganz.

Relatoren für URIs: Bevor wir Relatoren umbenennen, muss erst die Verträglichkeit geprüft werden, und zwar mit

  • Credits-Darstellung in filmportal.de und mit
  • Anwendungen, die die Datenexporte verwenden (Goethe-Institut, Bundesarchiv, dffb, ...)

Kristina: an Werk21/kelly haben wir bereits eine Mail geschrieben, wie es mit den Auswirkungen auf filmportal.de aussähe, wenn wir Relatoren (bzw. die Bezeichnungen) ändern würden.

Abgleich mit vorhandenen Relationen

Für die einzelnen Vokabulare sollte auf jeden Fall geprüft werden, wie die verwendeten Identifikatoren derzeit in der ZDB-Relationentabelle aussehen. Eine Abfrage für die Agent-Relationen sähe beispielsweise so aus:

 SELECT Rel, COUNT(Rel) As Anz FROM relation WHERE 
    (((SubjEnt="P") AND (ObjEnt="P"))
    OR ((SubjEnt="P") AND (ObjEnt="KS"))
    OR ((SubjEnt="KS") AND (ObjEnt="KS"))
    OR ((SubjEnt="KS") AND (ObjEnt="KS")))
 GROUP BY Rel 

und für die Credit-Relationen so:

 SELECT Rel, count(Rel) AS Anz FROM relation WHERE 
   (SubjEnt="FW") AND ((ObjEnt="KS") OR (ObjEnt="P"))
  GROUP BY Rel ORDER BY Rel

Identifikatoren für URIs

Tatsächlich können wir bei den RDF-Darstellungen durchgehend mit IRIs arbeiten, d.h. aufgelöste Umlaute ("Auffuehrung" statt "Auffphrung") sind nicht nötig. Im Identifikatoren-Teil müssen nur vorhandene Leerzeichen und einige Interpunktion (/, &, ", ?, : ) vermieden bzw. ersetzt werden.

Frage: Wollen wir es beim derzeitigen Durcheinander belassen, oder eine einheitliche Verwendung von IRIs (also das Beseitigen von "ae", "oe" etc.) anstreben?