Högskolan i Skövde

his.sePublications
Change search
CiteExportLink to record
Permanent link

Direct link
Cite
Citation style
  • apa
  • apa-cv
  • ieee
  • modern-language-association-8th-edition
  • vancouver
  • Other style
More styles
Language
  • de-DE
  • en-GB
  • en-US
  • fi-FI
  • nn-NO
  • nn-NB
  • sv-SE
  • Other locale
More languages
Output format
  • html
  • text
  • asciidoc
  • rtf
Language models in digital forensic investigations, how do they fare?
University of Skövde, School of Informatics.
2025 (English)Independent thesis Basic level (degree of Bachelor), 20 credits / 30 HE creditsStudent thesis
Abstract [sv]

En ny teknologi har nyligen kommit in rampljuset, nämligen språkmodeller, vilket ofta refereras som 'AI'. Men denna teknologi är fortfarande ny, och dess tillförlitlighet är fortfarande osäker. En fråga är dock, hur skulle denna nya teknologin kunna användas inom digital forensik? Att utforska hur språkmodeller kan hantera bevis samt generellt hjälpa en forensisk utredning är en fråga värt att undersöka. Och då är frågan, i vilka olika fält språkmodeller kunna användas och vara mest effektiva? Och hur jämförs denna nya teknologin i jämförelse med nuvarande verktyg? För att undersöka detta så utfördes en litteraturöversikt, där forskning från de senaste åren samlades och analyserades. Genom detta så undersöktes språkmodellers tillförlitlighet, och var deras styrkor och svagheter ligger. Det finns lite forskning inom detta fält, men språkmodeller visar att det finns potential inom digital forensik, men det finns mycket varians inom de olika forskningarna kring modellerna. Och även de modeller som utvärderas högt i hur korrekta deras utformning var, så var det fortfarande svårt att värdera på grund av variationen mellan forskningen. Finjusterade modeller samt ramverk verkar ha stor potential, men ytterligare forskning måste göras för att fastställa hur rimliga de är att implementera. Och även i de allra bästa och pålitliga modellerna, så är det viktigt för användare av dessa modeller att vara på utkik efter misstag. Och att verifiera resultaten ifall någon form av 'hallucination' dyker upp.

Abstract [en]

The emerging technology of language models, often referred to as 'AI', has garnered a lot of attention in the past few years, but the technology is still fresh and uncertain, and a bigger question emerges: How can this technology be applied in the realm of digital forensics? Exploring the advantages of how language models may help a digital forensics investigator could prove invaluable in expediting the forensic process, such as by processing large amounts of evidence or working as a co-investigator. In order to examine the viability of this however, contemporary literature was collected, studied, and analyzed in a systematic manner. This allowed us to investigate where language models shine and where they falter, and whether their reliability to 'hallucinate' imposes a great problem. While there isn't much research in relation to digital forensics in particular, language models show promise within the field, but there is great variance in the evaluations of these models, which makes many of even the well performing models appear inconsistent. Fine-tuned local models and larger frameworks show the most promise, but more research needs to be done to ascertain their full potential and feasibility to implement. That being said, even the most consistent models will invariably make some mistakes and contain some form of errors or 'hallucinations'. It is up to the users of these language models to take into account and correct any mistakes.

Place, publisher, year, edition, pages
2025. , p. ii, 44
Keywords [en]
Digital forensics, language models, large language models
Keywords [sv]
Digital forensik, språkmodeller, stora språkmodeller
National Category
Information Systems
Identifiers
URN: urn:nbn:se:his:diva-25461OAI: oai:DiVA.org:his-25461DiVA, id: diva2:1982926
Subject / course
Informationsteknologi
Educational program
Network and Systems Administration
Supervisors
Examiners
Available from: 2025-07-09 Created: 2025-07-09 Last updated: 2025-09-29Bibliographically approved

Open Access in DiVA

fulltext(554 kB)418 downloads
File information
File name FULLTEXT01.pdfFile size 554 kBChecksum SHA-512
cef252c10b212051e0655fd9848cc50211ec59e8273d9537134d39f34faaad48f9827569329593315eb5bec5b38dca0844b06f199172d1131854d00a58223267
Type fulltextMimetype application/pdf

By organisation
School of Informatics
Information Systems

Search outside of DiVA

GoogleGoogle Scholar
Total: 419 downloads
The number of downloads is the sum of all downloads of full texts. It may include eg previous versions that are now no longer available

urn-nbn

Altmetric score

urn-nbn
Total: 374 hits
CiteExportLink to record
Permanent link

Direct link
Cite
Citation style
  • apa
  • apa-cv
  • ieee
  • modern-language-association-8th-edition
  • vancouver
  • Other style
More styles
Language
  • de-DE
  • en-GB
  • en-US
  • fi-FI
  • nn-NO
  • nn-NB
  • sv-SE
  • Other locale
More languages
Output format
  • html
  • text
  • asciidoc
  • rtf