Microsoft har open source-udgivet code-testing-generator, en polyglot unit-test-agent der nu ligger i det MIT-licenserede dotnet/skills repository. Agenten adskiller sig ved at læse hele repositoryet før den skriver noget – den detekterer sprog, testframework, eksisterende konventioner og de faktiske build- og testkommandoer, før den planlægger, skriver, kører og validerer de tests den producerer.
På Microsofts interne benchmark med 152 opgaver fuldførte agenten 140 opgaver mod 120 for stock GitHub Copilot på samme model – en stigning fra 78,9% til 92,1% task completion. Gevinsten er koncentreret næsten udelukkende i vage prompts og diff-targeted requests, hvilket er præcis de situationer hvor udviklere ofte spilder tid.
For beslutningstagere betyder det noget, fordi det adresserer et af de største problemer med AI-kodning: pålideligheden. Hvis en agent kan læse konteksten og validere sit eget output, bliver den ikke bare en autocomplete-maskine, men en reel assistent der kan løfte kvaliteten i testdækningen – uden at skulle holdes i hånden. Open source-udgivelsen betyder også, at virksomheder kan tilpasse og integrere agenten i deres egen pipeline uden lock-in.
