遇见数据集

Corpus der Entscheidungen des Bundesgerichtshofs (CE-BGH)

收藏
Zenodo2025-05-24 更新2026-05-25 收录
数据链接:
官方服务:

资源简介:

<strong>Überblick</strong> Das <strong>Corpus der Entscheidungen des Bundesgerichtshofs (CE-BGH)</strong> ist der bislang größte, frei verfügbare Datensatz von Entscheidungen des Bundesgerichtshofs. Er ist eine Zusammenstellung aller Entscheidungen die in der amtlichen Datenbank des Bundesgerichtshofs am jeweiligen Stichtag veröffentlicht waren. <em>Bitte beachten Sie das beiliegende Codebook!</em> Es enthält wichtige Informationen zur korrekten Nutzung des Datensatzes. Es hilft auch bei der Entscheidung, welche Variante für Sie am besten geeignet ist. In der Regel empfehle ich für quantitative Forschung die CSV-Dateien und für traditionelle Forschung die PDF-Sammlung. Für Praktiker:innen stelle ich zusätzlich nach Senat sortierte PDF-Sammlungen aller <em>Leitsatzentscheidungen</em> und aller <em>Entscheidungen mit Namen</em> (z.B. »Trabrennbahn«) zur Verfügung. <strong>Aktualisierung</strong> Dieser Datensatz wird <em>ca. alle 6 Monate</em> aktualisiert. Benachrichtigungen über neue und aktualisierte Datensätze veröffentliche ich immer zeitnah auf Twitter unter @FobbeSean. <strong>NEU in Version 2021-04-27</strong> Insgesamt 31 Variablen Für Praktiker:innen: PDF-Sammlungen aller Leitsatzentscheidungen und aller Entscheidungen mit Namen Verknüpfung mit Präsident:in/Vize-Präsident:in Linguistische Kennzahlen (Zeichen, Tokens, Typen, Sätze) Stark verbessertes Codebook Umfangreicher Compilation Report für den Erstellungs-Prozess 49 hochwertige Diagramme und Tabellen für alle Zwecke (im ZIP-Archiv »ANALYSE«). Jedes Diagramm liegt in einem für den Druck (PDF) und das Web (PNG) optimierten Format vor. Tabellen sind im CSV-Format bereitgestellt und sind damit sowohl für Menschen als auch für Maschinen gut lesbar. Veröffentlichung des Source Codes Kryptographische Signaturen <strong>Features</strong> Fortlaufende Aktualisierung Urheberrechtsfreiheit Sowohl für traditionelle Rechtsanwender als auch für Legal Tech-Anwendungen geeignete Formate (PDF, TXT, CSV). <strong>Eckdaten</strong> <em>Stichtag:</em> 27. April 2021 <em>Inhaltlicher Umfang</em>: 66.344 Entscheidungen (Version 2021-04-27) <em>Zeitlicher Umfang:</em> 2000 bis 2021 (Version 2021-04-27) <em>Formate:</em><strong> </strong>PDF, TXT und CSV <strong>Source Code und Compilation Report</strong> Der gesamte Erstellungs-Prozess ist ab Version 2021-04-27 vollautomatisiert und detailliert dokumentiert. Mit jeder Kompilierung des vollständigen Datensatzes wird auch ein umfangreicher Compilation Report in einem attraktiv designten PDF-Format erstellt (ähnlich dem Codebook). Der Compilation Report enthält den vollständigen Source Code, dokumentiert relevante Rechenergebnisse, gibt sekundengenaue Zeitstempel an und ist mit einem klickbaren Inhaltsverzeichnis versehen. Er ist zusammen mit dem Source Code hinterlegt. Wenn Sie sich für Details des Erstellungs-Prozesses interessieren, lesen Sie diesen bitte zuerst. Der <em>vollständige Source Code</em> — sowohl für die Erstellung des Datensatzes, als auch für das Codebook — ist <em>öffentlich einsehbar und dauerhaft erreichbar</em> im wissenschaftlichen Archiv des CERN unter diesem Link hinterlegt: https://doi.org/10.5281/zenodo.4705865 <strong>Kryptographische Signaturen</strong> Die Integrität und Echtheit der einzelnen Archive des Datensatzes sind durch eine <em>Zwei- Phasen-Signatur</em> sichergestellt. In <em>Phase I</em> werden während der Kompilierung für jedes ZIP-Archiv Hash-Werte in zwei verschiedenen Verfahren (SHA2-256 und SHA3-512) berechnet und in einer CSV-Datei dokumentiert. In <em>Phase II</em> wird diese CSV-Datei mit meinem persönlichen geheimen GPG-Schlüssel signiert. Dieses Verfahren stellt sicher, dass die Kompilierung von jedermann durchgeführt werden kann, insbesondere im Rahmen von Replikationen, die persönliche Gewähr für Ergebnisse aber dennoch vorhanden ist. Die während der Kompilierung des Datensatzes erstellte CSV-Datei mit den Hash-Prüfsummen ist mit meiner <em>persönlichen GPG-Signatur</em> versehen. Der mit dieser Version korrespondierende Public Key ist sowohl mit dem Datensatz als auch mit dem Source Code hinterlegt. Er hat folgende Kenndaten: <em>Name:</em> Sean Fobbe (fobbe-data@posteo.de) <em>Fingerabdruck:</em> FE6F B888 F0E5 656C 1D25 3B9A 50C4 1384 F44A 4E42 <strong>Kein Urheberrecht: Public Domain</strong> An den Entscheidungstexten und amtlichen Leitsätzen besteht gem. § 5 Abs. 1 UrhG <em>kein </em>Urheberrecht, da sie amtliche Werke sind. § 5 UrhG ist auf amtliche Datenbanken analog anzuwenden (BGH, Beschluss vom 28.09.2006 - I ZR 261/03, "Sächsischer Ausschreibungsdienst"). Alle eigenen Beiträge (z.B. durch Zusammenstellung und Anpassung der Metadaten) und damit den gesamten Datensatz stelle ich gemäß einer CC0 1.0 Universal Public Domain License vollständig urheberrechtsfrei. <strong>Disclaimer</strong> Dieser Datensatz ist eine private wissenschaftliche Initiative und steht weder mit dem Bundesgerichtshof noch mit den Herausgebern der BGHZ/BGHSt in Verbindung. <strong>Weitere Open Access Veröffentlichungen (Fobbe)</strong> Website<em> </em>—<em> </em>www.seanfobbe.de Open Data — zenodo.org/communities/sean-fobbe-data/ Source Code — zenodo.org/communities/sean-fobbe-code/ Volltexte regulärer Publikationen — zenodo.org/communities/sean-fobbe-publications/ <strong>Kontakt</strong> Fehler gefunden? Anregungen? Melden Sie diese entweder im Issue Tracker auf GitHub oder schreiben Sie mir eine E-Mail an fobbe-data@posteo.de

提供机构:
Zenodo
创建时间:
2021-04-27
二维码
社区交流群
二维码
科研交流群
商业服务