Putz, Jonas (2026) Vergleich von Methoden zur syntaktisch und semantisch korrekten Python-Codegenerierung durch Sprachmodelle. Bachelorarbeit, Duale Hochschule Baden-Württemberg Mannheim.
|
PDF
1MB |
Kurzfassung
Die zunehmende Verbreitung generativer Sprachmodelle hat die automatische Codegenerierung in der Softwareentwicklung vorangetrieben. Trotz dieser Fortschritte weisen die erzeugten Programme häufig syntaktische und semantische Fehler auf, wie zum Beispiel bei der Nutzung externer Bibliotheken. Ziel dieser Bachelorarbeit ist es, die Wirksamkeit verschiedener Code-Generierungsmethoden zur Reduktion solcher Fehler zu evaluieren. Im Fokus stehen dabei die Methoden Temperature-Sampling, Sampling & Filtering, Post-Revising, AdapT, RoCode sowie ein neu entwickelter Context-Adaptive Sampler, der syntaktische Korrektheit durch statische Analyse und gezielte Token-Filterung garantiert.
Die Arbeit gliedert sich zunächst in theoretische Grundlagen zu Sprachmodellen und formalen Sprachen, anschließend in die Beschreibung der jeweiligen Generierungsmethoden, Implementierungsdetails und schließlich den experimentellen Aufbau auf dem HumanEval-Benchmark. Für vier Qwen-Modelle (500 Millionen bis 7 Milliarden Parameter) werden PassRate, Token-Verbrauch und Generierungszeit verglichen. RoCode erreicht mit 95, 4% PassRate die höchste Performance, während der Kontext adaptive Ansatz keine syntaktischen Fehler erzeugt und gleichzeitig die schnellste Generierungszeit erzielt. AdapT verbessert die PassRate im Durchschnitt um etwa 3, 8% gegen¨uber reinem Temperature-Sampling, während Sampling & Filtering und Post-Revising den größten Token-Verbrauch
aufweisen.
Die Ergebnisse zeigen, dass eine Kombination aus statischer Analyse und Ausführungstests (RoCode) die beste Fehlerreduktion liefert, während der Context-Adaptive Sampler besonders effizient, modular und gezielt bestimmte Fehlerquellen eliminiert. Die Arbeit schließt mit einer Antwort auf die Forschungsfrage und Vorschläge für zukünftige Verbesserungen.
| elib-URL des Eintrags: | https://elib.dlr.de/226492/ | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Dokumentart: | Hochschulschrift (Bachelorarbeit) | ||||||||
| Titel: | Vergleich von Methoden zur syntaktisch und semantisch korrekten Python-Codegenerierung durch Sprachmodelle | ||||||||
| Autoren: |
| ||||||||
| DLR-Supervisor: |
| ||||||||
| Datum: | 24 August 2026 | ||||||||
| Open Access: | Ja | ||||||||
| Seitenanzahl: | 71 | ||||||||
| Status: | veröffentlicht | ||||||||
| Stichwörter: | LLM; Codegenerierung; Constraint Decoding; Python | ||||||||
| Institution: | Duale Hochschule Baden-Württemberg Mannheim | ||||||||
| Abteilung: | Informatik; künstliche Intelligenz | ||||||||
| HGF - Forschungsbereich: | Luftfahrt, Raumfahrt und Verkehr | ||||||||
| HGF - Programm: | Raumfahrt | ||||||||
| HGF - Programmthema: | Technik für Raumfahrtsysteme | ||||||||
| DLR - Schwerpunkt: | Raumfahrt | ||||||||
| DLR - Forschungsgebiet: | R SY - Technik für Raumfahrtsysteme | ||||||||
| DLR - Teilgebiet (Projekt, Vorhaben): | R - Synergieprojekt DLR Foundation Models [SY] | ||||||||
| Standort: | Berlin-Adlershof | ||||||||
| Institute & Einrichtungen: | Institut für Softwaretechnologie > Intelligente und verteilte Systeme | ||||||||
| Hinterlegt von: | Putz, Jonas | ||||||||
| Hinterlegt am: | 10 Sep 2026 14:26 | ||||||||
| Letzte Änderung: | 10 Sep 2026 14:26 |
Nur für Mitarbeiter des Archivs: Kontrollseite des Eintrags