Et nyt forskningsframework, TriQua, adresserer en central udfordring i evalueringen af, hvor faktuel korrekte sprogmodeller er: balancen mellem granularitet og kontekst. Traditionelt bruger man 'decompose-then-verify', hvor udsagn opdeles i atomare fakta — men det kan fjerne vigtig kontekst, mens bredere udsagn mister præcision.

TriQua løser dette ved at lade fakta tilpasse sig kompleksiteten: Simple påstande repræsenteres som standard tripler, mens komplekse påstande udvides med kvalifikatorer, der bevarer nødvendig kontekst. Dette giver både præcis verifikation og forklarbarhed, da fejl kan knyttes direkte til specifikke dele af faktumet.

For beslutningstagere er det væsentlige, at TriQuaScore — den tilhørende scoringsmetode — viser stærk overensstemmelse med menneskelige vurderinger af faktualitet. Det betyder, at virksomheder, der bygger eller køber AI-løsninger, kan få mere pålidelige værktøjer til at validere output, hvilket er kritisk i regulerede brancher eller hvor fejl har store konsekvenser.

Selvom frameworket er forskningsbaseret, peger resultaterne på en mere robust metode til faktatjek, som kan integreres i fremtidige evalueringssystemer. For nu er det værd at følge med i, hvordan det udvikler sig til praktiske værktøjer.