Detailansicht

Few-shot prompting vs. chain-of-dictionary prompting of large language models for machine translation with a multilingual knowledge graph
Carina Obster
Art der Arbeit
Masterarbeit
Universität
Universität Wien
Fakultät
Zentrum für Translationswissenschaft
Studiumsbezeichnung bzw. Universitätlehrgang (ULG)
Joint-Masterstudium Multilingual Technologies
Betreuer*in
Miguel Angel Rios Gaona
Volltext in Browser öffnen
Alle Rechte vorbehalten / All rights reserved
DOI
10.25365/thesis.81354
URN
urn:nbn:at:at-ubw:1-17380.47171.261969-1
Link zu u:search
(Print-Exemplar eventuell in Bibliothek verfügbar)

Abstracts

Abstract
(Deutsch)
Die vorliegende Masterarbeit untersucht, ob Multilinguale Wissensgraphen (MKGs) als Quelle für In-Context-Learning-Beispiele genutzt werden können, um die domänenspezifische Maschinelle Übersetzung (MT) mit Large Language Models (LLMs) zu verbessern. Anstatt ausschließlich auf satzparallele Daten zurückzugreifen, wird erforscht, inwiefern strukturierte mehrsprachige Terminologie aus einem Wissensgraphen zur Konstruktion von Prompts eingesetzt werden kann, die die crosslingualen Fähigkeiten und das Reasoning-Potenzial von LLMs gezielter aktivieren. Als Datenbasis dient EuroVoc, der mehrsprachige Thesaurus der Europäischen Union, der als Wissensgraph eingebunden wird. Evaluiert werden drei LLMs – GPT-5, DeepSeek-V3 und TowerLLM – anhand von EU-spezifischer Rechtsterminologie aus dem EUR-Lex-Korpus. Es werden zwei Methoden miteinander verglichen: eine Few-Shot-Baseline, bei der einschlägige Satzpaare als In-Context-Beispiele verwendet werden, sowie eine auf dem Chain-of-Dictionary-Ansatz (CoD) basierende Methode, bei der mehrsprachige Terminologieketten aus dem Wissensgraphen in den Prompt eingebettet werden. Die Ergebnisse zeigen, dass KG-basierte Prompts die Übersetzungsqualität für domänenspezifische Terminologie partiell verbessern können, wobei die Wirksamkeit stark modellabhängig ist. GPT-5 erzielt durchgehend die besten Ergebnisse und profitiert am stärksten von der vorgeschlagenen Methode. TowerLLM belegt eine mittlere Position, während DeepSeek-V3 die schwächsten Resultate aufweist und kaum von der CoD-Methode profitiert. Die Baseline-Methode erweist sich als stärker bei fest etablierten EU-Glossareinträgen, während die CoD-Methode bei idiomatischer Natürlichkeit und terminologischer Nuanciertheit Vorteile zeigt. Die Arbeit schließt mit einer Diskussion der Limitationen und Ansätzen für zukünftige Forschung, darunter die Einbeziehung relationaler KG-Strukturen und hybride Prompting-Strategien.

Schlagwörter

Schlagwörter
(Deutsch)
Wissensgraphen In-Context-Learning Maschinelle Übersetzung Large Language Models Terminologie Prompting EuroVoc Few-Shot-Prompting Chain-of-Thought-Prompting GPT Deepseek TowerLLM
Schlagwörter
(Englisch)
Knowledge Graphs In-Context-Learning Machine Translation Large Language Models Terminology Prompting EuroVoc Few-Shot Prompting Chain-of-Thought Prompting GPT Deepseek TowerLLM
Autor*innen
Carina Obster
Haupttitel (Englisch)
Few-shot prompting vs. chain-of-dictionary prompting of large language models for machine translation with a multilingual knowledge graph
Publikationsjahr
2026
Umfangsangabe
ii, 66 Seiten : Illustrationen
Sprache
Englisch
Beurteiler*in
Miguel Angel Rios Gaona
Klassifikationen
17 Sprach- und Literaturwissenschaft > 17.45 Übersetzungswissenschaft ,
54 Informatik > 54.72 Künstliche Intelligenz ,
54 Informatik > 54.75 Sprachverarbeitung
AC Nummer
AC17912354
Utheses ID
81196
Studienkennzahl
UA | 066 | 587 | |
Universität Wien, Universitätsbibliothek, 1010 Wien, Universitätsring 1