Thought leaders
De onderhoudsvalkuil: waarom AI-vibe-testen de toekomst van QA zijn

Kunstmatige intelligentie heeft het ritme van softwareontwikkeling veranderd. Met tools zoals GitHub Copilot en ChatGPT kan code nu in minuten worden gegenereerd in plaats van weken, en interfaces evolueren bijna dagelijks. Toch is kwaliteitsborging, de discipline die bedoeld is om betrouwbaarheid te beschermen, de grootste bottleneck in de industrie geworden. Wat ontwikkelaars ooit automatisering noemden, lijkt nu steeds meer op handmatig werk. Tests mislukken niet omdat applicaties kapot gaan, maar omdat testseries dat doen.
Het probleem ligt niet in onze tools, maar in onze aannames. Jarenlang heeft de industrie kwaliteitsborging behandeld als een procedurele oefening, een reeks van klikken, controle en verificatie. Die mentaliteit had zin toen software langzaam bewoog, maar dat is niet langer het geval. De nieuwe ontwikkelingssnelheid vereist testen die even snel kunnen aanpassen als de code die ze beschermen. Ik noem deze evolutie vibe-testen, wat kwaliteitsborging is die intentie begrijpt, context interpreteert en reageert op verandering in plaats van eronder te bezwijken.
De cijfers onderstrepen de urgentie. De wereldwijde softwaretestmarkt overschreed $51,8 miljard in 2023 en zal naar verwachting 7 procent per jaar groeien tot 2032. Het automatiseringstestsegment alleen, gewaardeerd op $28,1 miljard in 2023, zal naar verwachting $55,2 miljard bereiken in 2028, een jaarlijkse groei van 14,5 procent. Ondanks deze investeringen blijven kwaliteitsborgingsteams vastzitten in reactieve cycli. Automatisering beloofde snelheid, maar leverde vaak broosheid. McKinsey heeft opgemerkt dat, ja, AI-geactiveerde softwareontwikkeling op fundamentele wijze de manier verandert waarop producten van begin tot eind worden gebouwd en de leveringssnelheid verhoogt, maar het ook extra druk uitoefent op testen en kwaliteitspraktijken om dat tempo bij te houden.
Automatisering beloofde te veel
Binnen organisaties herhaalt hetzelfde patroon zich. Teams brengen hun dagen door met het repareren van broze scripts die falen om redenen die niets te maken hebben met productkwaliteit. Een enkele wijziging in een gebruikersinterface, zoals een hernoemde knop, een nieuwe lay-out of een toegevoegde stap, kan honderden tests breken. Elke correctie genereert meer onderhoud. Dit heeft ertoe geleid dat automatisering hetzelfde is geworden als wat het probeerde te elimineren, namelijk repetitief werk.
Procedurele automatisering was gebaseerd op de aanname dat interfaces stabiel blijven en gebruikersreizen voorspelbaar blijven. Die aanname heeft de continue implementatie, A/B-testen en real-time personalisatie niet overleefd. Moderne systemen zijn van nature flexibel. De enige manier waarop kwaliteitsborging kan bijhouden is door te leren gedrag en betekenis te interpreteren in plaats van statische coördinaten op een scherm.
Dit is de onderhoudsvalkuil. Automatisering die bedoeld was om ontwikkeling te versnellen, vertraagt het eigenlijk omdat het onderhoudsverzoek sneller groeit dan de geleverde waarde. Het paradox is een van de grote mislukkingen van de moderne software-engineering.
Waarom generatieve AI het punt miste
De opkomst van generatieve AI gaf velen in het veld hoop dat de redding nabij was. Als AI code kon schrijven, kon het zeker testen. Maar de realiteit is meer bescheiden. De meeste zogenaamde “AI voor QA”-tools zijn nog steeds afhankelijk van zwakke logica. Ze genereren scripts sneller dan mensen, maar die scripts blijven gebonden aan dezelfde selectors en afhankelijkheden die ons altijd hebben laten falen. Als gevolg daarvan toont een uitgebreide academische studie aan dat, ondanks de brede interesse in AI-geactiveerd testen, de werkelijke adoptie in testteams beperkt blijft.
Deze systemen versnellen de handeling van het schrijven van tests zonder de handeling van het waarborgen van kwaliteit te transformeren. Ze kunnen Selenium-scripts met snelheid produceren, maar ze breken nog steeds als een UI-element verplaatst of een variabele naam verandert. En hoewel AI-testtools bestaan, waaronder van bedrijven die de ruimte al verder helpen, is de bredere industrieverschuiving nog niet materialiseerd. De meeste oplossingen focussen nog steeds op codegeneratie in plaats van intentiebegrip.
Van scripts naar semantiek
Echte transformatie vereist AI-systemen die begrijpen waarom een interactie ertoe doet, niet alleen hoe het wordt uitgevoerd. Vibe-testen gaan voorbij procedurele nauwkeurigheid naar ervaringsgerichte begrip. In plaats van te verifiëren dat “knop A leidt tot pagina B”, wordt beoordeeld of “de gebruiker het beoogde resultaat bereikt, zelfs als de interface is veranderd.”
Wanneer een bankapplicatie de inlogstroom opnieuw ontwerpt, breekt een traditionele suite, terwijl een vibe-test systeem intentie herkent, de nieuwe weg vindt, het resultaat valideert en autonoom doorgaat. Het verschil bepaalt of kwaliteitsborging innovatie mogelijk maakt of blokkeert.
Deze aanpak vermindert flakiness, vermindert onderhoudskosten en laat kwaliteitsborgingsteams toe om te focussen op exploratoire testen en nieuwe functies in plaats van gebroken scripts te repareren. Op grote schaal wordt het niet alleen een technische verschuiving, maar ook een economische.
De economie van intentie
In financiële diensten, waar regelgevingsupdates constant zijn, heeft intentie-gebaseerde testen complianceverificatie schaalbaar gemaakt zonder kwaliteitsborgingsteams evenredig uit te breiden. Het World Quality Report van Capgemini, Sogeti en OpenText beschrijft hoe kwaliteitsengineerteams AI en meer intelligente automatisering gebruiken om bij te houden met snellere leveringscycli en toenemende systeemcomplexiteit.
In e-commerce, waar interfaces continu evolueren door A/B-experimenten en personalisatie, hebben bedrijven die intentie-gedreven benaderingen hanteren, de testonderhoudstijd met ongeveer 40 procent vermindert binnen drie maanden. Enterprise SaaS-aanbieders die meerdere implementatieomgevingen beheren, gebruiken dezelfde logica om kwaliteit over alle varianten te behouden zonder overhead te verpletteren.
Deze patronen laten zien dat we het niet hebben over incrementele verbetering. We hebben het over een fundamentele verschuiving in wat economisch haalbaar is in kwaliteitsborging.
Veiligheidsmaatregelen voor een autonome toekomst
Geen paradigmaschuiving komt zonder voorbehoud. Systemen die zichzelf opnieuw opbouwen en herschrijven, vereisen nog steeds menselijke toezicht. AI kan domeinlogica verkeerd interpreteren als het niet getraind is op de juiste context. Kwaliteitsborgingleiders moeten strenge validatieprocessen handhaven, vooral in gereguleerde sectoren waar fouten echte risico’s met zich meebrengen.
Verklaarbaarheid en traceerbaarheid worden ook kritiek. Naarmate kwaliteitsborging intelligenter wordt, moet elke test opnemen hoe het is geëvolueerd en waarom het is geslaagd of mislukt. In banken en verzekeringen is dat niveau van auditeerbaarheid een wettelijke vereiste.
Intelligente systemen excelleren in primaire gebruikersstromen, maar kunnen zeldzame of risicovolle gevallen missen. Beveiligingskwetsbaarheden, compliance-scenario’s en data-integriteitsrandgevallen zijn nog steeds afhankelijk van door mensen gemaakte tests en diepe domeinkennis. En culturele weerstand blijft echt. Teams die zijn ondergedompeld in Selenium- of Cypress-workflows, zullen niet over een nacht ijs gaan. De overgang vereist investeringen in training, veranderingen in het management en duidelijke demonstraties van waarde.
De verschuiving naar adaptieve kwaliteitsborging
De bedrijven die vibe-testen het meest effectief toepassen, delen een gemeenschappelijk patroon. Ze beginnen klein, vaak door een hoog-veranderlijke applicatiegebied te testen naast hun traditionele suites. Ze meten de resultaten zorgvuldig, volgen de onderhoudsuren en de flakiness-ratio’s, en breiden alleen uit als de resultaten duurzaam blijken te zijn. Ze investeren in het helpen van kwaliteitsborgingsteams om te evolueren van scriptschrijvers naar intentiemodellen en kwaliteitsdirecteuren in plaats van uitvoerders. Ze integreren adaptieve AI rechtstreeks in hun DevOps-pijplijn, zodat tests aanpassen als de code verandert in plaats van te breken.
De bredere les is evenzeer filosofisch als technisch. Automatisering, zoals we die hebben beoefend, heeft geprobeerd onzekerheid te elimineren door controle. Vibe-testen accepteert dat verandering constant is en ontwerpt ervoor. Het behandelt testen niet als een poort aan het einde van de ontwikkeling, maar als een levendige conversatie tussen code, gebruiker en systeem. Het resultaat is software die evolueert zonder integriteit te verliezen.
Kwaliteitsborging staat nu op een kruispunt. Een pad leidt dieper de onderhoudsvalkuil in, waar scripts zich vermenigvuldigen en innovatie stagneert. Het andere pad leidt naar adaptieve, intentie-gedreven testen, software die zichzelf voldoende begrijpt om het eigen gedrag te valideren. De keuze zal bepalen welke organisaties bijhouden met de AI-versnelde toekomst en welke vastzitten in het debuggen van het verleden.
De komende tien jaar van kwaliteitsborging zullen niet worden gemeten door hoeveel we automatiseren, maar door hoeveel we begrijpen. En de winnaars zullen zijn die systemen bouwen die de pols van hun producten voelen, met andere woorden, de vibe, en dienovereenkomstig aanpassen.












