Full text
Daidalos-Projekt II KI-Infrastruktur für interdisziplinäre Forschung an lateinischen und altgriechischen Texten Konstantin Schulz & Andrea Beyer Humboldt-Universität zu Berlin 17. Dezember 2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 1/66
Überblick 1. Was bisher geschah 2. Wie es weitergehen soll 3. Phantastische Korpora und wo sie zu finden sind 4. Im Dschungel der Methoden 5. Large Language Models in einer Forschungsinfrastruktur? 6. Digitale Forschungskompetenz: ohne geht’s nicht Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 2/66
Was bisher geschah Was bisher geschah Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 3/66
Was bisher geschah Daidalos I: Wer, Was, Wie? Forschungsinfrastruktur für Klassische Philologie (v.a. Literaturwissenschaft), Schwerpunkt NLP beteiligte Einrichtungen: KorpLing, CMS, Klassische Philologie DFG, LIS, e-Research-Technologien, 2023-2026 verlängerbar um weitere 3 Jahre (bis ca. 2030) Webseite: https://daidalos-projekt.de ▶Folien in der Zenodo-Community Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 4/66
Was bisher geschah Förderlinie: e-Research-Technologien Aufund Ausbau von Infrastruktur keine eigene Forschung gefordert Nachhaltigkeit & Softwareentwicklung im Vordergrund Schulungsmaßnahmen und begleitende Evaluationen (Tests, Interviews o.Ä.) sind explizit erwünscht Befristung vs. Verstetigung Herausforderung: Betriebsmodell & langfristige Finanzierung Hettrick 2016 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 5/66
Was bisher geschah Zentrale Anforderungen an Daidalos I 1Wie können wir Forschenden aus der Literaturwissenschaft für Latein und Altgriechisch helfen, NLP für ihre Vorhaben zu nutzen? 2Wie müssen Sprachressourcen für Latein und Altgriechisch evaluiert und aufbereitet werden, damit sie gut nachnutzbar sind? 3Wie können wir Leerstellen in der altsprachlichen NLP-Forschung prototypisch ausfüllen? Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 6/66
Was bisher geschah Ein paar Antworten 1Participatory Research: Forschungstandems, Workshops, Beratung, Open Educational Resources, No-Code-Interface 2Evaluation & Interoperabilität: systematisches Evaluationsframework für KI-Modelle und Datensätze, inkl. Dokumentation und Metadaten (SEFLAG); Vektorisierung, verteiltes Hosting für Hochverfügbarkeit von Daten 3LLMs & Explainable AI: systematischer Vergleich von NLP & LLMs, Methodenframework Schulz u. a. 2024, Cobb 2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 7/66
Was bisher geschah Worum es im folgenden Vortrag nicht gehen wird Community-Arbeit: Workshops, Forschungstandems, Team-Teaching-Lehre, Social Media Usability-Evaluationen: Interviews, Wireframes Software Prototyping, Cloud-Infrastruktur, High Performance Computing SEFLAG 1.0 Antragsstruktur: 6 Arbeitspakete, 16 Letters of Intent, Umfeldund Bedarfsanalyse Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 8/66
Wie es weitergehen soll Wie es weitergehen soll Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 9/66
Wie es weitergehen soll Daidalos: soziale und technische Infrastruktur Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 16/66
Phantastische Korpora und wo sie zu finden sind Phantastische Korpora und wo sie zu finden sind Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 17/66
Phantastische Korpora und wo sie zu finden sind Editionsphilologie dominiert die deutsche Forschungslandschaft in der Klassischen Philologie, zusammen mit Literaturwissenschaft wird adressiert durch ▶API: Einsatz in dynamischen web-basierten Editionen, z.B. GOHABerlin ▶Methoden wie Named Entity Recognition ▶geeignete Workshops Textkritik: eComparatio Bräckel u. a. 2019, Beyer u. a. 2025a Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 18/66
Phantastische Korpora und wo sie zu finden sind Technische Standards & Dokumentation Referenzierbarkeit antiker Texte durch Distributed Text Services offene Korpora: Rohtext (Perseus, Corpus Corporum, CoMMA, MQDQ), Annotationen (GLAUx, LASLA), Annotationsrichtlinien (Translation Alignment) Linked Open Data: LiLa Hochverfügbarkeit von Servern, insbesondere Korpus-Repositories Roelli 2014, Keersmaekers 2021, Fantoli u.a. 2022, Passarotti u. a. 2022, Yousef u. a. 2022, Venuti u. a. 2023, Crane u. a. 2024, Clérice u. a. 2025, Cayless u. a. o. D. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 19/66
Phantastische Korpora und wo sie zu finden sind Fachspezifische Anforderungen spezielle Informationsbedürfnisse bei der Suche nach literarischen Textpassagen TEI/XML, Canonical Text Services Schwerpunkt auf POS-Tagging & Parsing, Autorschaft, Intertextualität, Textkritik Blackwell u. a.2015, Sommerschield u. a. 2023, Bogers u. a. 2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 20/66
Im Dschungel der Methoden Im Dschungel der Methoden Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 21/66
Im Dschungel der Methoden Was Daidalos I bereits bietet ... Lemmatisierung Sentimentanalyse Word Embeddings lokale Prototypen ▶Part-of-Speech-Tagging ▶Dependency Parsing ▶Textklassifikation Faltin u. a. 2024 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 22/66
Im Dschungel der Methoden Internationale Forschung Surveys zu altgriechischer Lemmatisierung und zu Machine Learning für antike Sprachen Methodenfokus: statistische Korpusuntersuchungen für Verb-Argument-Strukturen; neuronale Netzwerke für Konjekturen in altgriechischen Inschriften Benchmarks: distributionelle Semantik (z.B. Synonymie); Intertextualität neue Algorithmen oder KI-Modelle: lateinische Lemma Embeddings; lateinisches spaCy-Modell McGillivray 2013, Sprugnoli u. a. 2019, Vatri u. a. 2020, Assael u. a. 2022, Burns 2023, Sommerschield u. a. 2023, Dexter u. a. 2024, Stopponi u. a. 2024 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 23/66
Im Dschungel der Methoden Vom Sinn und Unsinn der Methoden Lemmatisierung: Schnittstellenfunktion, Durchsuchbarkeit Sentimentanalyse: “people’s opinions, sentiments, evaluations, attitudes, and emotions” Word Embeddings: z.B. Konjekturen in Texteditionen, Intertextualität, Autorschaft Balakrishnan u. a. 2014, Mambrini u. a. 2019, Sprugnoli 2021, Sommerschield u.a. 2023, Schulz 2024 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 24/66
Im Dschungel der Methoden Plinius über die Schwierigkeiten der Selbstdarstellung Schulz 2024, Beyer u. a. 2025c Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 25/66
Large Language Models in einer Forschungsinfrastruktur? Evaluation SEFLAG: Model Cards & Datasheets Hugging-Face-Ökosystem für Linked Open Data: Datensatz, KI-Modell, Evaluationsmetrik & -ergebnis, alles inkl. technischer Dokumentation forschen mit vs. forschen über LLMs Kombination aus Benchmarking und menschlicher Evaluation Mitchell u. a. 2019, Hashimoto u. a. 2019, Gebru u. a. 2021, Schulz u. a. 2024, Kotschka 2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 32/66
Large Language Models in einer Forschungsinfrastruktur? Explainable AI begründender Textoutput führt zu faktentreuerer KI flexibler Echtzeit-Zugriff auf externe Wissensressourcen LLMs sind besonders anfällig durch die Häufigkeit bestimmter Aufgabentypen oder Inputbzw. Output-Strukturen Atanasova u. a. 2020, Komeili u. a. 2021, McCoy u.a. 2023 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 33/66
Large Language Models in einer Forschungsinfrastruktur? Input-Empfindlichkeit von GPT (McCoy u.a. 2023) Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 34/66
Large Language Models in einer Forschungsinfrastruktur? Usability natürlichsprachige Nutzung der Daidalos-API: Model Context Protocol &OpenAPI LLMs generalisieren besser als kleinere Modelle mit Fine-Tuning auf kleinen Datensätzen In-Context-Learning: weniger Annotation nötig, aber Vernachlässigung des Inhalts gegenüber der Struktur beliebige Steuerung der Antwortlänge & -komplexität Kuratierungsdilemma: vorgefertige Prompts (hohe Qualität, wenig Flexibilität) vs. spontane Interaktion (mehr Engagement, mehr Halluzination) Senkung der technischen Bedienungshürden für Datenbanken Min u. a. 2022, Pal Chowdhury u.a. 2024, Sullutrone 2024, Chalkidis u.a. 2025, Muennighoff u. a. 2025, Zhu u. a. 2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 35/66
Large Language Models in einer Forschungsinfrastruktur? Technische Herausforderungen der KI-Nutzung Bedarf nach Unterstützung durch professionelle IT-Abteilungen mit Cloud-Architektur Datenschutz: Wo und von wem wird die KI betrieben? Sicherheit: Was darf ich der KI erzählen? aufwendiges Hosting On-Premises vs. externe Abhängigkeit Almas 2017, Dreyer 2024, Deriyeva u. a. 2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 36/66
Large Language Models in einer Forschungsinfrastruktur? Ökonomie & Ökologie Inferenz ist teurer als Training, bzgl. Strom, CO2, Geld ▶Einzelanwendung : 1 Training ist teurer als 1 Inferenz ▶Infrastruktur: 1000 Inferenzen sind teurer als 1 Training mehr Produktivitätssteigerung für unerfahrene als für erfahrene Arbeitskräfte Weidinger u. a. 2021, Maslej u. a. 2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 37/66
Digitale Forschungskompetenz: ohne geht’s nicht Digitale Forschungskompetenz: ohne geht’s nicht Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 38/66
Digitale Forschungskompetenz: ohne geht’s nicht Digital Literacies Digital Literacy - Data Literacy - AI Literacy = Digital Literacies (“Daidalos: KI in der Klassischen Philologie - Historical Languages and AI” 2026): Unter Digital Literacies versteht man alle (Teil-)Fähigkeiten, die einem dabei helfen, sich kritisch, selbstreflektiert und mündig mit den Anforderungen einer digitalen und KI-durchdrungenen Umwelt auseinander zu setzen. Diese Kompetenzen erstrecken sich ebenso auf den (gestaltenden) Umgang mit Daten, Methoden und Infrastrukturen wie auf das Verstehen von Konzepten oder das Entwickeln von Ideen, die Annahmen hinterfragen, neue Denkansätze hervorbringen oder Vorhandenes neuartig miteinander verknüpfen. Gilster 1997, Buckingham 2010, Ridsdale u. a. 2015, Long u. a. 2020, Schmidt u. a. 2021, Laupichler u. a. 2022, Vuorikari u. a. 2022, Petras u. a. 2025, Commission u. a.2025 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 39/66
Digitale Forschungskompetenz: ohne geht’s nicht Kompetenzmodell am Beispiel (vgl. Beyer 2025) Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 40/66
Digitale Forschungskompetenz: ohne geht’s nicht Minimalanforderung, vgl. Beyer u.a. 2024 Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 41/66
Literatur Literatur III Beyer, A. und K. Schulz (14. Sep. 2024). “Fachund fallspezifische KI-Bildung in den Geisteswissenschaften”. doi: 10.5281/zenodo.13757021. — (11. Sep. 2025b). “Auswertung der Evaluationen im Projekt”. doi: 10.5281/zenodo.17099269. — (23. Jan. 2025c). “LLM & NLP in der Klassischen Philologie: Digitale Literaturwissenschaft für alle?” doi: 10.5281/zenodo.14679224. — (27. Juni 2025d). “NER: Von lexikon-bis chatbasiert”. doi: 10.5281/zenodo.15722725. Blackwell, C. und N. Smith (2015). The Canonical Text Services URN Specification, Version 2.0.Rc.1. Bogers, T. u. a. (2025). “Understanding Complex Casual Leisure Information Needs: An Analysis of Search Requests for Books, Games, Movies and Music”. In: Journal of Documentation 81.1, S. 168–194. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 48/66
Literatur Literatur IV Bräckel, O., H. Kahl, F. Meins und C. Schubert (2019). “eComparatio – a Software Tool for Automatic Text Comparison”. In: Digital Classical Philology. Hrsg. von M. Berti. Berlin; Boston: De Gruyter Saur, S. 221–38. Buckingham, D. (2010). “Defining Digital Literacy”. In: Medienbildung in Neuen Kulturräumen. Hrsg. von B. Bachmair. Wiesbaden: Verl. für Sozialwissenschaften, S. 59–71. doi: 10.1007/978-3-531-92133-4âĂŮ. Burns, P. J. (2023). “LatinCy: Synthetic Trained Pipelines for Latin NLP”. In: arXiv preprint arXiv:2305.04365. arXiv: 2305.04365. Cayless, H. u. a. (o. D.). Distributed Text Services.Version 1.0rc1. Chalkidis, I., S. Brandl und P. Aslanidis (2025). “Identifying Fine-grained Forms of Populism in Political Discourse: A Case Study on Donald Trump’s Presidential Campaigns”. In: arXiv preprint arXiv:2507.19303. arXiv: 2507.19303. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 49/66
Literatur Literatur V Chen, Y. u. a. (2025). “Reasoning Models Don’t Always Say What They Think”. In: arXiv preprint arXiv:2505.05410. arXiv: 2505.05410. Clérice, T. u. a. (Dez. 2025). CoMMA, a Large-scale Corpus of Multilingual Medieval Archives.url: https://inria.hal.science/hal-05299220 (besucht am 10. 12. 2025). Vorveröffentlichung. Cobb, G. (26. Nov. 2025). Module 1: Introduction to Digital Classics / Einführung in die Digital Classics.Open Educational Resource. Version 1.0. Zenodo. doi:10.5281/zenodo.17724154. Commission, E. und OECD, Hrsg. (2025). Empowering Learners for the Age of AI. An AI Literacy Framework for Primary and Secondary Education. Crane, G. u. a. (2024). “The Sixth Generation of the Perseus Digital Library and a Workflow for Open Philology–DRAFT”. In: arXiv preprint arXiv:2411.10604. arXiv: 2411.10604. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 50/66
Literatur Literatur VI “Daidalos: KI in der Klassischen Philologie - Historical Languages and AI” (2026). In Vorbereitung. Dedema, M. und R. Ma (2024). The Collective Use and Perceptions of Generative AI Tools in Digital Humanities Research: Survey-based Results.arXiv: 2404.12458.url: https://arxiv.org/pdf/2404.12458. Vorveröffentlichung. Deriyeva, A., J. Dannath und B. Paassen (2025). “SCRIPT: Implementing an Intelligent Tutoring System for Programming in a German University Context”. In: Artificial Intelligence in Education. Posters and Late Breaking Results, Workshops and Tutorials, Industry and Innovation Tracks, Practitioners, Doctoral Consortium, Blue Sky, and WideAIED. Hrsg. von A. I. Cristea u. a. Cham: Springer Nature Switzerland, S. 168–177. doi:10.1007/978-3-031-99261-2_16. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 51/66
Literatur Literatur VII Dexter, J. P. u. a. (29. Jan. 2024). “A Database of Intertexts in Valerius Flaccus’ Argonautica: A Benchmarking Resource for the Evaluation of Computational Intertextual Search of Latin Corpora”. In: Journal of Open Humanities Data 10.1. doi:10.5334/johd.153. Dreyer, M. (2024). “Digital Sovereignty – Results from the ZKI Survey in DACH”. In: Proceedings of EUNIS 2024 Annual Congress in Athens. EUNIS 2024 Annual Congress. Athens, S. 180–171. doi: 10.29007/zmwf. Faltin, N. und K. Schulz (13. Juli 2024). “Automatisierte Kategorisierung Mittellateinischer Bittbriefe an Den Papst”. doi: 10.5281/zenodo.13628818. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 52/66
Literatur Literatur VIII Fantoli, M. u. a. (Juni 2022). “Linking the LASLA Corpus in the LiLa Knowledge Base of Interoperable Linguistic Resources for Latin”. In: Proceedings of the 8th Workshop on Linked Data in Linguistics within the 13th Language Resources and Evaluation Conference. LDL 2022. Hrsg. von T. Declerck u. a. Marseille, France: European Language Resources Association, S. 26–34. Fickers, A. (2020). “Update Für Die Hermeneutik. Geschichtswissenschaft Auf Dem Weg Zur Digitalen Forensik?” In: Zeithistorische Forschungen–Studies in Contemporary History 17.1, S. 157–168. Filograsso, F., A. Massari, C. Neri und S. Peroni (21. Aug. 2025). HERITRACE in Action: The ParaText Project as a Case Study for Semantic Data Management in Classical Philology.arXiv: 2508.15556 [cs].url:http://arxiv.org/abs/2508.15556 (besucht am 02. 12. 2025). Vorveröffentlichung. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 53/66
Literatur Literatur IX Gebru, T. u. a. (2021). “Datasheets for Datasets”. In: Communications of the ACM 64.12, S. 86–92. arXiv: 1803.09010. Gilster, P. (1997). Digital Literacy.Wiley Computer Publishing. New York, NY: Wiley. 276 S. Gledić, J. u. a. (25. Juni 2021). Survey of Curricula: Linguistics and Language-Related Degrees in Europe.Zenodo. Gu, J., Z. Lu, H. Li und V. O. Li (2016). “Incorporating Copying Mechanism in Sequence-to-Sequence Learning”. In: arXiv preprint arXiv:1603.06393. arXiv: 1603.06393. Hashimoto, T. B., H. Zhang und P. Liang (2019). “Unifying Human and Statistical Evaluation for Natural Language Generation”. In: arXiv preprint arXiv:1904.02792. arXiv: 1904.02792. Hellman, D. (5. Mai 2021). Big Data and Compounding Injustice. SSRN Scholarly Paper 3840175. Rochester, NY: Social Science Research Network. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 54/66
Literatur Literatur X Hettrick, S. (2016). Research Software Sustainability: Report on a Knowledge Exchange Workshop.The Software Sustainability Institute. Keersmaekers, A. (2021). “The GLAUx Corpus: Methodological Issues in Designing a Long-Term, Diverse, Multi-Layered Corpus of Ancient Greek”. In: Proceedings of the 2nd International Workshop on Computational Approaches to Historical Language Change 2021, S. 39–50. Komeili, M., K. Shuster und J. Weston (15. Juli 2021). “Internet-Augmented Dialogue Generation”. arXiv: 2107.07566 [cs]. Korbak, T. u. a. (2025). “Chain of Thought Monitorability: A New and Fragile Opportunity for Ai Safety”. In: arXiv preprint arXiv:2507.11473. arXiv: 2507.11473. Kotschka, F. (21. Sep. 2025). “Die Grenzen des Wissens für KI-Modelle”. Masterarbeit. Berlin: Humboldt-Universität zu Berlin. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 55/66
Literatur Literatur XI Kuehnast, M., K. Schulz und A. Lüdeling (31. Dez. 2024). “Development of Basic Reading Skills in Latin: A Corpus-Based Tool for Computer-Assisted Fluency Training”. In: Cogent Education 11.1, S. 2416819. doi:10.1080/2331186X.2024.2416819. La Veglia, A. (2024). “Being a Classicist in the Digital Age”. In: Digital Papyrology III: The Digital Critical Edition of Greek Papyri: Issues, Projects, and Perspectives. Hrsg. von N. Reggiani. Berlin, Boston: De Gruyter, S. 49–70. doi:10.1515/9783111070162. Laupichler, M. C., A. Aster, J. Schirch und T. Raupach (1. Jan. 2022). “Artificial Intelligence Literacy in Higher and Adult Education: A Scoping Literature Review”. In: Computers and Education: Artificial Intelligence 3, S. 100101. doi:10.1016/j.caeai.2022.100101. Lin, S., J. Hilton und O. Evans (2021). “Truthfulqa: Measuring How Models Mimic Human Falsehoods”. In: arXiv preprint arXiv:2109.07958. arXiv: 2109.07958. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 56/66
Literatur Literatur XII Long, D. und B. Magerko (2020). “What Is AI Literacy? Competencies and Design Considerations”. In: Proceedings of the 2020 CHI Conference on Human Factors in Computing Systems. CHI Conference on Human Factors in Computing Systems, S. 1–16. Mambrini, F. und M. Passarotti (2019). “Harmonizing Different Lemmatization Strategies for Building a Knowledge Base of Linguistic Resources for Latin”. In: Proceedings of the 13th Linguistic Annotation Workshop, S. 71–80. Maslej, N. u. a. (20. Nov. 2025). Artificial Intelligence Index Report 2025.doi:10.48550/arXiv.2504.07139. arXiv: 2504.07139 [cs]. url:http://arxiv.org/abs/2504.07139 (besucht am 17. 12. 2025). Vorveröffentlichung. McCoy, R. T. u. a. (24. Sep. 2023). “Embers of Autoregression: Understanding Large Language Models Through the Problem They Are Trained to Solve”. In: arXiv.org. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 57/66
Literatur Literatur XIX Sullutrone, G. (2024). “Large Language Models Integration in Digital Humanities”. In: Proceedings of the 32nd Symposium of Advanced Database Systems, Villasimius, Italy, June 23rd to 26th, 2024. Hrsg. von M. Atzori u. a. Bd. 3741. CEUR Workshop Proceedings. CEUR-WS.org, S. 717–723. Team, G. u. a. (18. Dez. 2023). Gemini: A Family of Highly Capable Multimodal Models.doi:10.48550/arXiv.2312.11805. arXiv: 2312.11805 [cs].url:http://arxiv.org/abs/2312.11805 (besucht am 28. 01. 2024). Vorveröffentlichung. Vatri, A. und B. McGillivray (12. Nov. 2020). “Lemmatization for Ancient Greek: An Experimental Assessment of the State of the Art”. In: Journal of Greek Linguistics 20.2, S. 179–196. doi: 10.1163/15699846-02002001. Venuti, M. u. a. (2023). “La ‘Galassia MQDQ:’Un Concetto Di Filologia Tradizionale, Digitale, Sostenibile”. In: magazén 4.1, S. 71–120. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 64/66
Literatur Literatur XX Vodă, A. I. u. a. (Jan. 2022). “Exploring Digital Literacy Skills in Social Sciences and Humanities Students”. In: Sustainability 14.5, S. 2483. doi:10.3390/su14052483. Vuorikari, R., S. Kluzer und Y. Punie (2022). DigComp 2.2: The Digital Competence Framework for Citizens - With New Examples of Knowledge, Skills and Attitudes.JRC Publications Repository. doi: 10.2760/115376.url:https://publications.jrc.ec.europa. eu/repository/handle/JRC128415 (besucht am 01. 04. 2025). Weidinger, L. u. a. (8. Dez. 2021). “Ethical and Social Risks of Harm from Language Models”. arXiv: 2112.04359 [cs]. Wendler, C., V. Veselovsky, G. Monea und R. West (8. Juni 2024). Do Llamas Work in English? On the Latent Language of Multilingual Transformers.doi:10.48550/arXiv.2402.10588. arXiv: 2402.10588 [cs].url:http://arxiv.org/abs/2402.10588 (besucht am 08. 01. 2025). Vorveröffentlichung. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 65/66
Literatur Literatur XXI Yong, Z.-X. u. a. (2025). “Crosslingual Reasoning through Test-Time Scaling”. In: arXiv preprint arXiv:2505.05408. arXiv: 2505.05408. Yousef, T., C. Palladino, D. J. Wright und M. Berti (2022). “Automatic Translation Alignment for Ancient Greek and Latin”. In: Proceedings of the Second Workshop on Language Technologies for Historical and Ancient Languages, S. 101–107. Zhu, R.-J. u. a. (4. Nov. 2025). Scaling Latent Reasoning via Looped Language Models.Version 2. doi:10.48550/arXiv.2510.25741. arXiv: 2510.25741 [cs].url:http://arxiv.org/abs/2510.25741 (besucht am 13. 11. 2025). Vorveröffentlichung. Schulz & Beyer (HU Berlin) KI-Infrastruktur Latein/Altgriechisch 17. Dezember 2025 66/66