Het dilemma in enkele gevallen: te veel vragen om grote taalmodellen
Gepubliceerd in: 3e internationale conferentie over fundamentele en grote taalmodellen (FLLM) in 2025
Yongjian Tang; Doruk Tuncel; Christian Koerner; Thomas Runkler
Te veel vragen doen zich voor wanneer te veel voorbeelden in prompts de LLM-prestaties verminderen, waardoor traditionele veronderstellingen van weinig leren in twijfel worden getrokken. Om dit dilemma te bestuderen, evalueerde een snel raamwerk willekeurige steekproeven, semantische inbedding en TF-IDF-vectorselectie in modellen zoals GPT-4O, DeepSeek-v3 en Llama-3.1. De resultaten tonen aan dat te veel domeinspecifieke voorbeelden paradoxaal genoeg afbreuk doen aan de nauwkeurigheid. Getest op datasets voor softwarevereisten, waarbij de gestratificeerde en door TF-IDF geselecteerde voorbeelden geleidelijk aan het licht kwamen. Deze aanpak voorkomt dat er te veel wordt gevraagd en presteert tegelijkertijd 1% beter dan de meest geavanceerde eisenclassificatie.
Bekijk op de pagina van de uitgever
Op LLM gebaseerde agentsystemen voor software-engineering: uitdagingen en kansen
Ingediend bij: SE2026, Gesellschaft für Informatik, Bonn
Yongjian Tang, Thomas Runkler
Ondanks de vooruitgang op het gebied van LLM vereisen complexe taken op het gebied van software-engineering een gezamenlijke, gespecialiseerde aanpak. In dit artikel wordt systematisch ingegaan op het opkomende paradigma van op LLM gebaseerde multi-agentsystemen gedurende de gehele levenscyclus van softwareontwikkeling, inclusief requirements engineering, codegeneratie, testen en debuggen. Het onderzoekt de selectie van modellen, evaluatiebenchmarks, agentiekaders en communicatieprotocollen. Daarnaast legt het werk de nadruk op belangrijke uitdagingen zoals orkestratie, coördinatie tussen mensen en agenten, kostenoptimalisatie en gegevensverzameling, wat essentiële inzichten biedt in de stand van zaken op het gebied van software engineering voor agenten.
Bekijk op de pagina van de uitgever
Modelgestuurde modernisering van legacy-systemen op grote schaal
Gepubliceerd in: ReCode '26: Proceedings van de eerste workshop over codevertaling, -transformatie en -modernisering, pagina's 13 ‑ 18
Tobias Böhm, Jens Guan Su Tien, Mohini Nonnenmann, Tom Schoonbaert, Bart Carpels, Andreas Biesdorf
Dit ervaringsrapport presenteert een modelgestuurde aanpak in vier fasen (analyse, verrijking, synthese, transitie) waarbij een technologieonafhankelijk tussenmodel wordt ingevoegd tussen oude codebases en moderne doelplatforms. Toegepast op een grote industriële .NET-toepassing migreert het semi-automatisch gebruikersinterfaces en paginastructuren naar moderne webstacks met behoud van functioneel gedrag. Door architectuurkennis te consolideren in expliciete modellen, verbetert dit de onderhoudbaarheid en de ervaring van ontwikkelaars. Ondanks de uitdagingen op het gebied van de lay-out die handmatige inspanningen vergen, beperkt de aanpak risico's, schaalt ze effectief en biedt ze herbruikbare patronen.
Bekijk op de pagina van de uitgever
Formele syntaxis en LLM-semantiek overbruggen: Kennisgrafieken extraheren om oude code te begrijpen
Gepubliceerd in: 23e internationale conferentie over Software Architecture Companion van de IEEE 2026 (ICSA‑C)
Henrik Thillmann; Bernhard Rumpe; Andreas Biesdorf
Gevestigde ondernemingen vertrouwen vaak op oude systemen die moeilijk te onderhouden zijn vanwege verouderde talen en onduidelijke identificatiegegevens. Als deze systemen worden vervangen, bestaat echter het risico dat hun bewezen betrouwbaarheid verloren gaat. Grote taalmodellen kunnen helpen bij het herstel en de modernisering van de architectuur, maar ze vereisen nauwkeurig contextbeheer. Aangezien code een parseerbare formele taal is, kan bij het ophalen gebruik worden gemaakt van de programmastructuur in plaats van te vertrouwen op ongestructureerde tekst. We stellen een op parsing gebaseerde methodologie voor om een structuurbewuste kennisgrafiek op te stellen voor GraphRag. Deze aanpak toont aan dat in een industriële casestudy een verbeterde zoeknauwkeurigheid en een architecturaal redeneren met meerdere hop is aangetoond.
Bekijk op de pagina van de uitgever