Find research datasets worth reusing
Search datasets from major research repositories and use ShareScore to quickly assess how well each record supports discovery, access, and reuse.
73
datasets available to search
ShareScore release 0.9.0
Dataset results
73 results for “TEI”
List of TEI rolename annotations in the ISicily EpiDoc corpus
<p>This CSV file details every instance of a 'roleName' tag in the I.Sicily (sicily.classics.ox.ac.uk) EpiDoc TEI files, reporting the ID number of the file in which it appears, and the value of the @type and @subtype attributes in each case - as such it serves as an index of roleName attestations in the I.Sicily dataset (also recoverable directly from the EpiDoc files). The file will be updated in future.</p>
simondschweitzer/aed-tei: AED-TEI Version 1.0
<ul> <li>Publication of more than 11000 Egyptian texts in the TEI format, and ... <ul> <li>TEI schema</li> <li>dictionary</li> <li>thesaurus</li> <li>morphological features</li> </ul> </li> <li>Project: AED - Ancient Egyptian Dictionary <a href="https://simondschweitzer.github.io/aed/">https://simondschweitzer.github.io/aed/</a></li> <li>License: CC-BY-SA-4.0</li> <li>Source: <a href="https://nbn-resolving.org/urn:nbn:de:kobv:b4-opus4-29190">https://nbn-resolving.org/urn:nbn:de:kobv:b4-opus4-29190</a></li> </ul>
Oráculo manual. Schopenhauer's marginalia (TEI-XML)
<p>XML-TEI file used in the project <em>Schopenhauer's Library. Annotations and marks in his Spanish books</em> <a href="http://schopenhauer.uni.wroc.pl">http://schopenhauer.uni.wroc.pl</a></p> <p> </p>
TEI-XML Zürcher Stillstandsprotokolle des 17. Jahrhunderts
<p><strong>Projekt eStPZH</strong></p> <p>Die Stillstandsprotokolle wurden als Worddokumente seriell transkribiert und anschliessend als PDF gespeichert. Die Konvertierung der Beschlüsse in XML geschah mittels VBA-Makros.</p> <p>Siehe auch: <a href="https://archives-quickaccess.ch/search/stazh/stpzh">https://archives-quickaccess.ch/search/stazh/stpzh</a></p> <p><strong>Inhalt</strong></p> <p>Die Zürcher Stillstandsprotokolle dokumentieren die Tätigkeit der ältesten Aufsichtsbehörde der reformierten Kirchgemeinden, des so genannten Stillstands. Das Gremium ist so benannt, weil dessen Mitglieder nach dem Gottesdienst in der Kirche wortwörtlich "stillstanden", also stehen blieben, um monatlich unter dem Vorsitz des Pfarrers zu beraten. Der Stillstand rekrutierte sich – neben dem Pfarrer – aus ex officio in das Gremium bestellten Inhabern weltlicher Ämter der Gemeinde sowie aus den von der Gemeinde gewählten Ehegaumern. Der Stillstand war zugleich Kirchen-, Schul-, Armen- und Vormundschaftsbehörde, aber auch lokale Instanz in sittlichen Fragen. An einigen Orten übernahm er zudem Funktionen der weltlichen Gemeindebehörden. Nach 1798 wurden seine Aufgabenbereiche auf rein kirchliche Angelegenheiten beschränkt; später wurde das Gremium durch die heutigen Kirchenpflegen ersetzt.<br> <br> Entsprechend den vielfältigen Aufgaben des Stillstands dokumentieren die vom jeweiligen Pfarrer verfassten Protokolle die ganze Bandbreite des Alltags und des Zusammenlebens der Menschen im Gebiet des damaligen Stadtstaats Zürich. Trotz ihrem hohen Quellenwert blieben die Zürcher Stillstandsprotokolle lange weitgehend unerforscht, nicht zuletzt, weil es sich häufig um eher flüchtige, schwer lesbare Notizen in der individuellen Handschrift des Pfarrers handelt.<br> <br> Die frühesten Stillstandsprotokolle setzen 1631 in Brütten und 1634 in Laufen ein, dann auf breiter Basis 1636/1637 in Fällanden, Gossau, Hedingen, Kyburg, Laufen, Lindau und Stallikon, was mit einem entsprechenden Synodalbeschluss vom Mai 1636 zusammenhängen mag, der in den Protokollen von Brütten und Fällanden angesprochen wird. Insgesamt sind (für unterschiedliche Zeiträume) für 35 Kirchgemeinden Protokolle vorhanden.<br> </p> <p><strong>Technische Erschliessung</strong></p> <p>Die Konvertierung von Worddokumenten in TEI-konforme XML-Dateien geschah mittels eines VBA-Makros, welches grösstenteils mittels Mustererkennung die einzelnen Datenelemente voneinander abgrenzte. </p> <p>mögliche Konvertierungsfehler:</p> <p>Insbesondere die Behandlung von eckigen Klammern für Textkommentare und Seitenumbrüche führte bei der Unterscheidung zu einzelnen Konvertierungsproblemen. <br> Allenfalls könnte das in seltenen Fällen noch zu fehlerhaften Dateien geführt haben.</p> <p>Validierung:</p> <p>Alle Dateien sind gemäss TEI-Schema valide. Nicht valide xml-Dateien wurden manuell verbessert.</p> <p>XSL-Stylesheet:</p> <p>Das Stylesheet befindet sich im selben Ordner ("Stylesheet.xsl") und ist mit leicht abweichendem, relativem Pfad eingebunden in den XML-Dateien (Zeile 2: <?xml-stylesheet type="text/xsl" href="../../Ressourcen/Stylesheet.xsl"?>). <br> Das Stylesheet ermöglicht eine Browseransicht, welche sich der originalen Transkription in Word annähert.</p> <p><br> <strong>Urheberrecht</strong></p> <p>Die Daten stehen unter einer Creative Commons CC-BY-SA 4.0 Lizenz.</p> <p>Herausgeber: Staatsarchiv des Kantons Zürich</p> <p>Technische Erschliessung: Rebekka Plüss, rebekka.pluess@ji.zh.ch </p> <p>Letztes Update: 14.08.2020</p>
XML Data for "Four Early Chan Texts from Dunhuang - A TEI-based Edition"
<p>This zip archive contains the XML data, schema, stylesheets, and associated material that are the basis for a print edition of 48 Dunhuang manuscript witnesses of four early Chan Buddhist texts. The print edition is:</p> <p>Marcus Bingenheimer 馬德偉, Chang Po-Yung 張伯雍 (eds.): <em>Four Early Chan Texts from Dunhuang – A TEI-based Edition</em> 早期禪宗文獻四部 —— 以TEI標記重訂敦煌寫卷:楞伽師資記,傳法寶紀,修心要論,觀心論. Taipei: Shin Wen Feng 新文豐, 2018.<br> (Vol. 1: Facsimiles and Diplomatic Transcription 摹寫版 (ISBN: 978-957-17-2274-0), Vol. 2: Parallel, Punctuated and Annotated Edition 對照與點注版 (ISBN: 978-957-17-2275-7), Vol. 3: Calligraphy Practice 抄經版 (ISBN: 978-957-17-2276-4).)</p> <p>See the included README.txt for further information.</p>
Automatic TEI encoding of manuscripts catalogues with GROBID-Dictionaries
<p>Manuscript Sales Catalogues (MSC) are highly important for authenticating documents and studying the reception of authors. Their regular publication throughout Europe since the beginning of the 19th c. has consequently raised the interest around scaling up the means for automatically structuring their contents. </p> <p>Following successful first encoding tests with <em>GROBID-Dictionaries</em> on a single MSC collection, we aim in this paper to present the results of more advanced tests of the system’s capacity to handle a larger corpus with MSC of different dealers, and therefore multiple layouts. Four different types of catalogues published between the middle of the 19th c. and the beginning of the 20th c. have been tested.</p>
TEI-XML Zürcher Regierungsratsbeschlüsse 1803-1887
<p><strong>Projekt TKR</strong></p> <p>Zwischen 2003–2016 wurden die Protokollbände des Regierungsrats und des Kantonsrats als Worddokumente seriell transkribiert und anschliessend in PDF und später als OGD-Datensätze in TEI-XML konvertiert.<br>Die Dateien werden unter Berücksichtigung der gesetzlichen Schutzfristen laufend (max. 80 Jahre) publiziert.</p> <p>Siehe auch: <a href="https://archives-quickaccess.ch/search/stazh/rrb">https://archives-quickaccess.ch/search/stazh/rrb</a></p> <p><strong>Inhalt</strong></p> <p>Dieses Datenset beinhaltet die <strong>handschriftlich verfassten Regierungsratsbeschlüsse des Kantons Zürich von 1803 bis 1887</strong>. Ab dem 1. Juli 1887 wurden die Regierungsratsbeschlüsse gedruckt. </p> <p>Die Beschlüsse des Regierungsrates gehören zu den zentralen Aktenserien des Kantons Zürich. <br>In ihnen spiegelt sich ein äusserst breites Spektrum an Themen, da der Regierungsrat nicht nur für grosse politische Entscheide, sondern oft auch für alltägliche Belange zuständig war. <br>Neben Themen wie Auswanderung oder Aufnahme von politischen Flüchtlingen, Bau von Eisenbahnen und Strassen oder Regulierung der stark ansteigenden Industrie beschäftigen den Regierungsrat stets auch Tagesgeschäfte wie Konzessionsgesuche für Tavernen oder Wasserkraftanlagen, Steuerrekurse, Einbürgerungen oder die Aufnahme von Kantonsfremden in kantonseigene Spitäler.<br>Die Metadaten eines Beschlusses (TEI/teiHeader) bestehen unter anderem aus dem Kürzel des/der Transkriptors/in, dem Transkriptionsdatum, der Signatur, dem Publikationsdatum, dem Titel des Beschlusses, dem Link zur Verzeichnung im Archivkatalog und dem Beschlussdatum.<br>Klassen und Bände bilden die hierarchische Ordnerstruktur.<br>Eine Klasse stellt jeweils den Zeitraum zwischen zwei politischen Umbrüchen dar: <br>Das Protokoll setzt 1803 mit der Bildung des modernen Kantons Zürich ein, die erste Klasse schliesst mit der Annahme der neuen restaurativen Verfassung im Juni 1814. <br>Die dritte Klasse setzt mit der liberalen Verfassung von 1831 ein; der Bruch ist auch daran erkennbar, dass der «Kleine Rat» von nun an «Regierungsrat» genannt wird. <br>Mit dem konservativen «Züriputsch» im September 1839 beginnt die vierte Klasse, welche 1849 mit einer gross angelegten Verwaltungsreform und der Integration des Kantons Zürich in den neuen schweizerischen Bundesstaat schliesst. <br>Mit der demokratischen Verfassung von 1869 setzt die sechste und letzte Klasse ein, welche nicht durch ein politisches Ereignis, sondern durch die Umstellung auf das gedruckte Protokoll endet. <br>Dies entspricht auch der Struktur im Archivverzeichnis.</p> <p><strong>Technische Erschliessung</strong></p> <p>Die Konvertierung von Worddokumenten in TEI-konforme XML-Dateien geschah mittels eines Python-Scripts, welches mittels Mustererkennung die einzelnen Datenelemente voneinander abgrenzte. </p> <p>Validierung:</p> <p>Alle Dateien sind gemäss TEI-Schema valide. Nicht valide xml-Dateien wurden manuell verbessert.</p> <p>XSL-Stylesheet:</p> <p>Das Stylesheet befindet sich im Ordner Ressourcen ("\Ressourcen\Stylesheet.xsl") und ist mit relativem Pfad eingebunden in den XML-Dateien (Zeile 2: <?xml-stylesheet type="text/xsl" href="../../Ressourcen/Stylesheet.xsl"?>). <br>Das Stylesheet ermöglicht eine Browseransicht, welche sich der originalen Transkription in Word annähert.</p> <p>Ab Version 3.0 wurden im ganzen Datensatz Eigennamen mittels maschinellem Lernen ausgezeichnet (vgl. <a href="https://github.com/machinelearningZH/named-entity-recognition_staatsarchiv">Github-Repository</a> zum Projekt). <em>Bitte beachten: </em>Die Auszeichnung wurde nicht manuell nachkontrolliert und kann Fehler enthalten!</p> <p><strong>Urheberrecht</strong></p> <p>Die Daten stehen unter einer Creative Commons CC-BY-SA 4.0 Lizenz.</p> <p>Herausgeber: Staatsarchiv des Kantons Zürich</p> <p>Technische Erschliessung: Rebekka Plüss, rebekka.pluess@zh.ch </p> <p>Projektleiter TKR: Luzi Schutz</p>
Wikibooks-Korpus: Korpusquellen von deutschsprachigen Wikibooks im TEI-Format
<p>Das <a href="https://www.dwds.de/d/korpora/wikibooks">Wikibooks-Korpus</a> auf <a href="http://www.dwds.de">dwds.de</a> enthält Volltexte aus deutschsprachigen Lehr-, Fach- und Sachbüchern von <a href="https://de.wikibooks.org/wiki/Hauptseite">Wikibooks</a> der Wikimedia Foundation auf der Basis des <a href="https://dumps.wikimedia.org/dewikibooks/20250701/">Datenbank-Abzugs vom 1. 7. 2025</a>. Texte aus anderen Seitenarten (Diskussionen etc.) wurden nicht aufgenommen.</p> <p>Das Wikibooks-Korpus wurde nach dem Vorbild des <a href="https://www.dwds.de/d/korpora/wikipedia">Wikipedia-Korpus</a> auf <a href="http://www.dwds.de">dwds.de</a> konzipiert. Es eignet sich damit insbesondere für die Recherche nach lexikographischen Belegen.</p> <p>Verfügbar sind hier die Quellen des Wikibooks-Korpus auf <a href="http://www.dwds.de">dwds.de</a> im XML/TEI-Format als teiCorpus-Datei. Wie die originalen Wikibooks-Artikel stehen sie unter der Lizenz <a href="https://creativecommons.org/licenses/by-sa/4.0/">"Creative Commons Attribution/Share Alike"</a>.</p>
morethanbooks/XML-TEI-Bible: XML-TEI Bible: Entities and communication (66 Books)
<p>This release contains the biblical text in XML-TEI (66 books). The encoded text is in Spanish, but the codification (elements, attributes, values, ids) is in English. It makes explicit following information:</p> <ul> <li>Books, chapters, pericopes and verses.</li> <li>References to peoples, places, times, groups and books, using ids.</li> <li>Direct speech, including who is communicating, to whom and how (written, oral, prayer...).</li> </ul>
Ancient Greek Literature for Advanced Data Processing: A Text Fabric Representation of Open Access Texts in TEI XML
<p>This data set contains a full conversion of Greek texts available in the Perseus Digital Library and the Open Greek and Latin Project to the Text Fabric data format. The main advantage of the Text Fabric datatype over the original TEI XML format is that it utilizes a strict separation of text and annotation in a flat data structure. At the same time, it permits multiple distinct formats of the same text as well as an unlimited depth of (embedded) annotations. Because of its flat data structure, it facilitates easy and clean procedures to analyze, transform, and enrich the available data. Many of these processes are very difficult to conduct while departing from the hierarchically organized XML tree representation.</p>
TEI-XML-Datenset der Tagebücher, Briefe, Dokumente, Forschungsbeiträge, Chronologieeinträge und Register der edition humboldt digital
<p>Das Datenset enthält alle edierten Texte (Tagebücher, Briefe und weitere Dokumente) sowie Paratexte (Forschungsbeiträge, Einträge der Chronologie zu Alexander von Humboldts Leben, Register und Glossar) der Version 11 der <a href="https://edition-humboldt.de">edition humboldt digital</a>, die am 4. Juni 2025 erschienen ist. Das Datenset enthält gegenüber der HTML-Version technische Fehlerkorrekturen, daher wird es als Version 11.0.1 veröffentlicht.</p> <p>Die Editionsrichtlinien stehen auf <a href="https://edition-humboldt.de/richtlinien/index.html">edition-humboldt.de</a> zur Vefügung. Das Datenmodell ist in drei verschiedene ODDs aufgeteilt (für edierte Texte, Registereinträge und Forschungsbeiträge). Dem Datenset liegen die drei RNG-Schemata bei, die ODD-Ursprungsdateien sind im GitHub-Repository <a href="https://github.com/telota/ediarum.AVHR.data-model/">ediarum.AVHR.data-model</a> zu finden. Beachten Sie bitte, dass es für das Pflanzenregister derzeit noch kein Schema gibt, da dieses aus dem Tagging automatisch erstellt wird.</p> <p>Weitere Hinweise zur digitalen Methodik finden sich in <a href="https://edition-humboldt.de/H0016212">Dumont 2024</a> und zum Editionsvorhaben im Allgemeinen in <a href="https://doi.org/10.25365/wdr-01-03-02">Kraft/Dumont 2020</a>.</p> <p>Dieses Datenset ist auch auf <a href="https://github.com/telota/edition-humboldt-digital">GitHub</a> zugänglich.</p>
TEI-Schema für das Patristische Textarchiv (PTA)
This dataset contains the TEI-Schema and its documentation
TEI survey 2021
<p>This dataset comprises the processing scripts, processed files, and summary statistics from a survey of two million publicly available TEI files on GitHub. The survey was carried out between December 2020 – May 2021 with the motivation of examining real-world usage of the Text Encoding Initiative guidelines.</p> <p>Outputs include counts of TEI and non-TEI tag usage, TEI modules, and other namespaces, languages declared, and lists of filenames/repositories.</p> <p>The processed files are plain text and consist of the tag names used within the corresponding TEI XML file, separated by spaces. E.g. file 1000001.txt contains:</p> <p>?xml TEI teiHeader fileDesc titleStmt title publicationStmt idno idno availability p p ref p ref p ref notesStmt note sourceDesc biblFull titleStmt title author extent publicationStmt date pubPlace profileDesc creation date textClass keywords term text body div div head head p p p p p pb p p pb</p> <p>Files with the XML attributes as well are available on request, due to size limitations.</p> <p> </p>
GRETIL - Göttingen Register of Electronic Texts in Indian Languages. TEI
<p>GRETIL - Göttingen Register of Electronic Texts in Indian Languages. TEI</p>
TEI-XML Encoding of Paris, Bibliothèque nationale de France, fonds français, 24432
<p><strong>Encoding Principles</strong></p> <p>Material divisions within the codex have been marked, with <span><gb></span>, <span><pb></span>, <span><cb></span>, and <span><lb></span> tags indicating the beginning of a new quire, folio, column, and line respectively, while <span><handShift></span> is used to mark the beginning of a section of work by a particular scribe. Individual texts, and their <em>incipit</em> and <em>explicit</em> markings have been separated through use of the <span><div></span> tag, with sections of prose marked using <span><p></span>, and sections of poetry marked using <span><lg></span>, with individual lines of verse tagged using <span><l></span>. When a text is dialogic in form, this is marked using <span><spGrp></span>, with contributions by individual speakers marked using <span><sp></span>. Direct speech within non-dialogic text has been marked with <span><q></span> where such details are pertinent to our analysis.</p> <p>Labels, marginal notes, catchwords, highlighted sections, moments of damage, gaps in text, and blank spaces are marked using <span><label></span>, <span><note></span>, <span><fw></span>, <span><hi></span>, <span><damage></span>, <span><gap></span>, and <span><space></span> respectively, while the table of contents is encoded as a table using the <span><table></span>, <span><cell></span>, and <span><row></span> tags.</p> <p>Within the text of the encoding, expansions of scribal abbreviation, additions and deletions by scribal or later hands, as well as editorial regularisations, corrections, suppressions and insertions have been encoded using the <span><expan></span>, <span><add></span>,<span><del></span>, <span><reg></span>, <span><corr></span>, <span><surplus></span>, and <span><supplied></span> elements respectively, alongside the unexpanded, unregularised and uncorrected version of the text, through the <span><abbr></span>, <span><orig></span>, and <span><sic></span> elements respectively. Where more than one variant of the same segment of text has been encoded, for example in cases of expanded abbreviation and regularisation, the variants have been contained within a <span><choice></span> tag. Again, where such details have been pertinent to our analysis, personal names, geographic names, dates, and numbers have been encoded within <span><persName></span>, <span><placeName></span>, <span><date></span> and <span><num></span> elements.</p>
《國臺對照活用辭典》XML-TEI
<p>《國臺對照活用辭典》(Mandarin-Taiwanese Dictionary) by 吳守禮</p> <p>(re-)digitization and conversion to XML-TEI by 阿石 (Pierre Magistry)<br> <br> In collaboration with Wikimedia Taiwan and g0v.tw</p> <p>See https://meta.wikimedia.org/wiki/Wikimedia_Taiwan/OpenWuDict<br> <br> Alpha version (trying Zenodo), contact Pierre Magistry for de</p> <p> </p> <p>https://meta.wikimedia.org/wiki/Wikimedia_Taiwan/OpenWuDict</p>
TEI-XML Zürcher Gesetzessammlung seit 1803
<p><strong>Projekt</strong></p> <p>Das Staatsarchiv des Kantons Zürich hat sämtliche Erlasse der Zürcher Gesetzessammlung von 1803-1998 als kontrollierten Volltext in Worddokumenten aufbereitet und anschliessend als PDF publiziert. Zusätzlich wurden diese Texte nun in TEI-XML konvertiert und als Open Government Data (OGD) online zur Verfügung gestellt.</p> <p>Siehe auch: <a href="https://archives-quickaccess.ch/search/stazh/os">https://archives-quickaccess.ch/search/stazh/os</a></p> <p><strong>Inhalt</strong></p> <p>Die "Offizielle Sammlung der Gesetze, Beschlüsse und Verordnungen des Eidgenössischen Standes Zürich" (OS) ist die Publikationsreihe für das kantonale Recht. Sämtliche Erlasse und rechtsetzenden Vereinbarungen sowie deren Inkraftsetzung, Änderung oder Aufhebung werden darin in chronologischer Reihenfolge veröffentlicht.</p> <p>Die erste Offizielle Gesetzessammlung wurde in der Mediationszeit 1803 begonnen (heute als OS AF für "Alte Folge" bezeichnet). Nach sechs Bänden stellte man dieses Werk zu Beginn der Restauration 1814 ein; an seine Stelle trat eine "Neue Folge" (OS NF), die sich in den folgenden vier Bänden wieder stärker an den alten Zuständen orientierte. Dieses Unterfangen wurde seinerseits durch die liberale Verfassung vom 10. März 1831 abgelöst. Die damals neu begründete Reihe wird bis heute fortgeführt (zitiert als OS).</p> <p>Fehlende oder bis dahin lediglich im Amtsblatt publizierte Erlasse wurden 1883 und 1888 in zwei Supplementbänden publiziert (OS 20, Suppl. 1 und 2). Mit der Herausgabe der systematisch geordneten Gesetzessammlung 1981 erhielten sämtliche noch gültigen Erlasse eine Ordnungsnummer. Diese bestimmt die systematische Einreihung innerhalb der seit 1993 ständig aktualisierten Loseblattsammlung (LS).</p> <p>Seit 1999 publiziert die Staatskanzlei die LS und OS auch online (<a href="https://www.zh.ch/de/politik-staat/gesetze-beschluesse/gesetzessammlung.html#zhlex">https://www.zh.ch/de/politik-staat/gesetze-beschluesse/gesetzessammlung.html#zhlex</a>).</p> <p>Das Datenset umfasst sämtliche Erlasse von 1803 bis 1998. Jeder Erlass bildet eine XML-Datei. Insgesamt handelt es sich um knapp 10'000 Erlasse bzw. Dateien.</p> <p>Die Metadaten eines Beschlusses (TEI/teiHeader) bestehen unter anderem aus dem Erlasstitel, dem Erlassdatum, der Bandnummer und der Seitenzahl (Signatur) sowie der ab 1981 vorhandenen Ordnungsnummer. Zusätzlich ist auch das Kürzel des/der Transkriptors/in und das Transkriptionsdatum vermerkt. Mit dieser neuen Version 2 sind auch Verlinkungen/Bezüge zu anderen Beschlüssen in den Metadaten vermerkt.</p> <p>Die "Alte Folge" (OS AF) umfasst den Zeitraum der Mediation von 1803 bis Juni 1814, die "Neue Folge" (OS NF) die Jahre der Restauration von Juni 1814 bis 1831. Die heute noch fortgesetzte Folge (OS) beginnt mit der liberalen Verfassung vom 10. März 1831. Der Datensatz endet bei der Umstellung der gedruckten Bände auf die Online-Publikation am Jahreswechsel 1998/1999.</p> <p>Dies entspricht auch der Struktur im Archivverzeichnis.</p> <p><strong>Technische Erschliessung</strong></p> <p>Die Konvertierung von Worddokumenten in TEI-konforme XML-Dateien geschah mittels eines VBA-Makros, welches grösstenteils mittels Mustererkennung und Formatierungen in Word die einzelnen Datenelemente voneinander abgrenzte.</p> <p>mögliche Konvertierungsfehler:</p> <p>Insbesondere die Behandlung von komplexeren Tabellen und Formeln mit Sonderzeichen führte zu einzelnen Konvertierungsproblemen.</p> <p>Allenfalls könnte das in seltenen Fällen noch zu Fehlern geführt haben.</p> <p>Validierung:</p> <p>Alle Dateien sind gemäss TEI-Schema valide. Nicht valide xml-Dateien wurden manuell verbessert.</p> <p>XSL-Stylesheet:</p> <p>Das Stylesheet befindet sich im Ordner Ressourcen ("\Ressourcen\Stylesheet.xsl") und ist mit relativem Pfad eingebunden in den XML-Dateien (Zeile 2: <?xml-stylesheet type="text/xsl" href="../../Ressourcen/Stylesheet.xsl"?>).</p> <p>Das Stylesheet ermöglicht eine Browseransicht, welche sich der originalen Transkription in Word annähert.</p> <p>Ab Version 4.0 wurden im ganzen Datensatz Eigennamen mittels maschinellem Lernen ausgezeichnet (vgl. <a href="https://github.com/machinelearningZH/named-entity-recognition_staatsarchiv">Github-Repository</a> zum Projekt). <em>Bitte beachten: </em>Die Auszeichnung wurde nicht manuell nachkontrolliert und kann Fehler enthalten!</p> <p><strong>Urheberrecht</strong></p> <p>Die Daten stehen unter einer Creative Commons CC-BY-SA 4.0 Lizenz.</p> <p>Herausgeber: Staatsarchiv des Kantons Zürich</p> <p>Technische Erschliessung: Rebekka Plüss, rebekka.pluess@zh.ch</p> <p>Projektleiter Aufbereitung Gesetzessammlung: Rainer Hugener, rainer.hugener@ji.zh.ch</p>
Tests for the TEI-CAT
<p>Test for the <a href="http://teicat.huma-num.fr">TEI Critical Apparatus Toolbox</a>, along with their outcome and summaries. They are related to an article to be published in <a href="https://ride.i-d-e.de/issues/">RIDE 14</a>.</p>
The TEI, Its Foundations and Impact, and How It Fits Into Today's Needs and Practices for Language Analysis
<p>6<sup>th</sup> Lecture</p>
TEI-XML Zürcher Amtsblatt 1954-2001
<p><strong>Projekt Amtsblatt</strong></p> <p>Im laufenden Projekt Amtsblatt (Start 2022) wird als vierte Serie der Zentralen Serien des Kantons Zürch (19. und 20. Jahrhundert) das Amtsblatt zur Online-Publikation im Volltext aufbereitet. Die Jahrgänge werden dabei ab 2001 chronologisch rückwärts tranchenweise publiziert. Dieser Datensatz umfasst die Jahrgänge 1954-2001.</p> <p><strong>Inhalt</strong></p> <p>Das Amtsblatt ist das Publikationsorgan für amtliche Mitteilungen der öffentlichen Organe des Kantons Zürich. Es wurde im Zuge der liberalen Kantonsverfassung von 1831 eingeführt. Während der ersten Jahrzehnte waren sämtliche Mitteilungen von verschiedenen eidgenössischen, kantonalen, Bezirks- oder Gemeindebehörden gemischt, 1879 wurde der sogenannte Inseratenteil vom Textteil mit den gesetzlichen Bekanntmachungen getrennt.</p> <p>Als Informationskanal für die Bürger und Bürgerinnen gedacht, musste das Amtsblatt bis zur Verlagerung ins Internet in sämtlichen zürcherischen Gaststätten ausgelegt werden. Es erschien zunächst zweimal pro Woche und ab 1995 nur noch einmal pro Woche. Ab 2002 veröffentlichte die Staatskanzlei das Amtsblatt zusätzlich zur gedruckten Ausgabe auch elektronisch. Seit 2018 werden die Meldungen nur noch <a href="https://www.amtsblatt.zh.ch/#!/gazette"><u>online</u></a> publiziert. Die Einzelheiten regeln das Publikationsgesetz (LS 170.5) und die Publikationsverordnung (LS 170.51).</p> <p>Für die Online-Publikation aufbereitet wird ausschliesslich der für den politischen Entscheidungsfindungs- und Gesetzgebungsprozess relevante Textteil; die Anzeigen des Inseratenteils (ab 1903 im Zeitungsformat) müssen im fraglichen Zeitraum weiterhin vor Ort im Staatsarchiv konsultiert werden.</p> <p>Weiterführende Informationen finden sich im <a href="https://suche.staatsarchiv.djiktzh.ch/detail.aspx?id=4546621">Online-Archivkatalog</a>. </p> <p><strong>Technische Erschliessung</strong></p> <p>Die Amtsblatt-Bände werden direkt in TEI-XML mit einem Tool der Firma Acodis (Winterthur) aufbereitet und danach mit einem vom Staatsarchiv entwickelten Skript in die einzelnen Meldungen segmentiert. </p> <p>Ab Version 2.0 wurden im ganzen Datensatz Eigennamen mittels maschinellem Lernen ausgezeichnet (vgl. <a href="https://github.com/machinelearningZH/named-entity-recognition_staatsarchiv">Github-Repository</a> zum Projekt). <em>Bitte beachten: </em>Die Auszeichnung wurde nicht manuell nachkontrolliert und kann Fehler enthalten!</p> <p><strong>Urheberrecht</strong></p> <p>Die Daten stehen unter einer Creative Commons CC-BY-SA 4.0 Lizenz.</p> <p>Herausgeber: Staatsarchiv des Kantons Zürich</p> <p>Projektleiter Projekt Amtsblatt: Rainer Hugener, rainer.hugener@ji.zh.ch</p>
ScienceDex guides
Understand access before you commit
These curated guides explain access requirements, typical timelines, costs, and reuse considerations for widely used research datasets.
Allen Brain Atlas
Allen Brain Atlas is an Allen Institute collection of brain map atlases, datasets, APIs, and analysis tools covering mouse, human, and non-human primate brain resources.
Annotated Behaviour and Observability Dataset (ABODe)
ABODe is a University of Edinburgh DataShare dataset for behavior classification in group-housed mice using home-cage video, identities, bounding boxes, ground-plate positions, and annotator labels.
DANDI Archive for NWB datasets
DANDI is a BRAIN Initiative archive for publishing and sharing neurophysiology data, including electrophysiology, optophysiology, and behavioral data packaged as NWB and related standards.
International Brain Laboratory public data
The International Brain Laboratory public data releases expose standardized mouse decision-making experiments, including Neuropixels recordings, widefield calcium imaging, behavior, and session metadata accessed through the ONE API.
OpenNeuro
OpenNeuro is a free, open platform for sharing neuroimaging datasets, with public search, dataset pages, and download paths for web, S3, DataLad, and the OpenNeuro CLI.