← Blog

De AI-agentpilot die inkoop overleeft

Een pilot die inkoop overleeft, heeft vijf dingen schriftelijk vastgelegd voordat er iets gebouwd wordt: één afgebakende workflow, één succesmaatstaf met een benoemde eigenaar die hem meet, een stopdrempel die het project zonder discussie beëindigt, een antwoord over dataverwerking dat uw securityteam al heeft gelezen, en een vaste prijs. Doe het betaald, 30 tot 90 dagen, op echte data. Pilots sterven niet in de demo. Ze sterven in de security review, en in de vergadering waarin niemand kan zeggen hoe succes eruit had moeten zien.

Voeg ons toe als voorkeursbron op Google

Een gratis Google-instelling om meer van onze relevante artikelen in uw zoekervaring te zien. U kunt dit altijd wijzigen.

Gartner verwacht dat meer dan 40 procent van de agentische AI-projecten eind 2027 geschrapt is, en noemt drie oorzaken: oplopende kosten, onduidelijke bedrijfswaarde en ontoereikende risicobeheersing. Elk daarvan wordt beslist vóór de eerste regel code, in de manier waarop de pilot is opgezet. Dit is de opzet die alle drie vermijdt.

Grafiek: de beslisregel in één overzicht. De randvoorwaarde beslist eerder dan de economie.

Belangrijkste punten

  • Betaald, 30 tot 90 dagen, één afgebakende workflow, echte data. Gratis proofs of concept worden bemand door wie toevallig tijd heeft en tegen niets afgezet.
  • Leg de succesmaatstaf en de stopdrempel vast vóór de bouw. De stopdrempel is het deel dat finance geruststelt en het deel waartegen leveranciers zich verzetten.
  • Beantwoord de securityvragen in week nul, niet in week zes. De security review is waar pilots echt sterven.
  • Benoem aan elke kant één menselijke eigenaar. Deloitte ontdekte dat slechts 21 procent van de organisaties volwassen governance voor agentische AI heeft, en beslisgrenzen zijn het grootste gat.
  • Sluit de pilot af met een besluit: uitbreiden, één keer verlengen of stoppen. Schrijf op welk besluit u verwacht voordat u begint, want een demo beslist het nooit voor u.

De vijf dingen die vastliggen voordat u bouwt

1. Eén afgebakende workflow

Eén taak, geen afdeling of platform, met een duidelijke trigger, een duidelijke eindtoestand en een telbare werkeenheid. Factuuruitzonderingen doorgezet. Inkomende leads gekwalificeerd en ingepland. Supporttickets gesorteerd en getagd. Uitgaande prospects gemarkeerd door een koopsignaal en als concept klaargezet voor goedkeuring door een persoon, de vorm uit hoe u een AI-systeem voor leadgeneratie bouwt dat echt werkt. Als u de workflow niet in één zin met een zelfstandig naamwoord en een werkwoord kunt beschrijven, is hij nog niet afgebakend, en groeit de pilot tot hij mislukt.

De test: kunt u zeggen hoe vaak deze workflow vorige maand draaide? Bestaat dat getal niet, haal het dan vóór de pilot op, want het is ook uw nulmeting.

2. Een schriftelijke succesmaatstaf met een benoemde meter

Eén primaire maatstaf, één getal, één persoon die het leest. Teruggewonnen uren per week, percentage items afgehandeld zonder menselijke tussenkomst, doorlooptijd, foutpercentage of kosten per transactie. Kies degene die op zichzelf de uitgave zou rechtvaardigen.

Twee regels wegen zwaarder dan de gekozen maatstaf. Ten eerste hoort de meter aan uw kant te staan, niet aan die van de leverancier; een leverancier die zijn eigen huiswerk nakijkt, is geen bewijs. Ten tweede legt u de nulmeting vast voordat de agent live gaat. Achteraf gereconstrueerde nulmetingen zijn altijd flatteus en worden nooit geloofd.

3. Een stopdrempel, schriftelijk overeengekomen

Het getal waaronder de pilot eindigt en niemand er opnieuw over begint. Als de maatstaf “60 procent van de tickets gesorteerd zonder menselijke correctie” is, kan de stopdrempel 35 procent zijn. Gemist op dag 60, dan stopt de opdracht, en uw totale blootstelling was al die tijd een begrensd bedrag.

Deze clausule maakt van een AI-experiment een normale inkoopbeslissing, en het is de clausule die leveranciers van elkaar scheidt. Een leverancier die zich tegen een stopdrempel verzet, vertelt u wat hij van zijn eigen kansen denkt.

4. Dataverwerking vooraf beantwoord

Hier sterven pilots. De demo ging goed. De prijs ging goed. Dan komt in week vijf een securityvragenlijst binnen, en het kost zes weken om die slecht te beantwoorden.

Zorg vóór de kickoff voor antwoorden op: welke data de agent leest en schrijft, waar die verwerkt worden, welke subverwerkers erbij kunnen, of de modellen trainen op uw input en output (het antwoord moet nee zijn, en herleidbaar tot de voorwaarden tussen de leverancier en de modelaanbieder), hoe toegang wordt verleend en ingetrokken, en of er al een verwerkersovereenkomst (DPA) bestaat die regelt hoe met uw data wordt omgegaan. Vraag de trustdocumentatie van de leverancier als link, niet als belofte. Als hij die voor u moet schrijven, hebt u het planningsrisico gevonden.

De onze staat openbaar op vertrouwen en beveiliging: beveiligingshouding, dataverwerking, subverwerkers, een governancesamenvatting afgestemd op de vier functies van het AI Risk Management Framework van het Amerikaanse National Institute of Standards and Technology (NIST), en een DPA op aanvraag. Wij hebben geen System and Organization Controls (SOC) 2-rapport, de standaard onafhankelijke beveiligingsaudit, en die pagina zegt dat openlijk, want een inkoopteam komt er toch achter.

5. Een vaste prijs, en wat de tweede workflow kost

Eén bedrag voor de afgebakende taak. Onze gepubliceerde kostenbanden voor AI-agents plaatsen een eenvoudige automatisering van één workflow bij een klein bureau op $3 000 tot $8 000; een pilot zoals hier beschreven, met shadow mode op echte data, een begeleide go-live en een schriftelijke stopdrempel, heeft een grotere scope, en de onze staat voor vast 25 000 tot 60 000 USD op onze prijspagina. Leg nu ook de prijs van workflow twee en drie vast, voordat de eerste werkt en uw onderhandelingspositie verdwijnt.

Het verloop in 30, 60 en 90 dagen

Dag 0 tot 7, vóór de bouw. Securityvragenlijst en DPA lopen. Nulmeting vastgelegd. Succesmaatstaf, stopdrempel en beide benoemde eigenaren akkoord. Toegang verleend met minimale rechten, in uw eigen systemen, door u intrekbaar.

Dag 7 tot 30, bouw en shadow. De agent draait op echte data maar voert geen onomkeerbare acties uit. Elke output wordt door een mens beoordeeld, en de meningsverschillen zijn het leersignaal. U meet nauwkeurigheid, nog geen tijdsbesparing.

Dag 30 tot 60, begeleid live. De agent handelt, een persoon keurt alles goed wat onomkeerbaar is, en het goedkeuringspercentage wordt de tweede maatstaf om te volgen. Worden vrijwel alle acties goedgekeurd, vergroot dan de autonomie. Zijn correcties frequent, dan hebt u de grens van de workflow gevonden, een nuttig resultaat ook als het de pilot beëindigt.

Dag 60 tot 90, beslissen. Drie uitkomsten, vooraf opgeschreven: uitbreiden naar de volgende workflow, één keer verlengen met een specifieke verbetering en een nieuwe datum, of stoppen. “Doorgaan en kijken” hoort daar niet bij, en zo wordt de 40 procent de 40 procent.

Wat uw security- en juridische teams zullen vragen

Stel dit samen vóór het eerste gesprek en u haalt weken uit de cyclus:

  • De modelvraag. Welke modellen, van welke aanbieders, onder welke voorwaarden, en trainen ze op onze data.
  • De datastroom. Wat onze omgeving verlaat, waar het terechtkomt, hoe lang het bewaard wordt, hoe het verwijderd wordt.
  • De lijst met subverwerkers. Namen, geen categorieën.
  • Toegang en intrekking. Platformeigen rollen die u verleent en zelf kunt intrekken, tegenover inloggegevens die de leverancier beheert. Het eerste is veel makkelijker goed te keuren.
  • De audittrail. Wat de agent deed, wanneer, op wiens gezag, door u leesbaar zonder de leverancier te vragen.
  • Grenzen van menselijke goedkeuring. Welke acties een persoon vereisen, op schrift. Het Deloitte-onderzoek van 2026 onder 3 235 IT- en bedrijfsleiders vond dat slechts 21 procent een volwassen governancemodel voor agentische AI heeft, met beslisgrenzen, realtime monitoring en audittrails als ontbrekende onderdelen. Uw beoordelaar weet dit.
  • Regelgevingspositie. Als u in de EU actief bent: het Digital Omnibus-akkoord heeft de meeste verplichtingen voor hoog risico onder de AI Act uitgesteld tot december 2027 en augustus 2028, maar de transparantieverplichtingen van artikel 50 gelden nog steeds vanaf 2 augustus 2026, inclusief melding wanneer iemand met een AI-systeem communiceert. Vraag de leverancier hoe de agent zich bekendmaakt.

De ontwerpfouten in pilots die we het vaakst zien

De interessante workflow automatiseren terwijl de dure met de hand blijft draaien. De interessante levert een mooie demo. De dure financiert de volgende drie.

Geen nulmeting. Zonder getal vooraf is elk getal achteraf een discussie.

Succes gedefinieerd als “het werkt”. In een demo werkt het altijd. Definieer het getal.

Een pilot die niet kan mislukken. Als er geen drempel is die hem stopt, hebt u geen pilot gekocht maar een eerste termijn betaald.

Twee leveranciers tegelijk op dezelfde workflow. Het voelt grondig en is het niet: geen van beide krijgt schone data, ze wijzen naar elkaar, en u betaalt dubbel om minder te leren.

Wat we in onze eigen organisatie doen

We passen deze opzet op onszelf toe. Onze interne agentvloot wint 50 uur of meer per week verspreid over het team terug, gebouwd één afgebakende workflow tegelijk, wekelijks beoordeeld, met een persoon die alles goedkeurt wat onomkeerbaar is. We draaien ook een openbare Model Context Protocol (MCP)-server op mcp.strataigize.com, de standaard waarmee een AI-agent een extern systeem kan aanroepen, zodat een agent ons bedrijf direct kan bevragen. We hebben geen ander bureau gevonden dat er een draait. Hij bestaat omdat we hem eerst zelf nodig hadden.

Daarom kunnen we een eerste workflow met een strak gezicht prijzen: we hebben de negende-maandversie hiervan in onze eigen organisatie doorlopen, niet alleen op een slide.

Grafiek: wat de bouw van een AI-agent echt kost. Echte prijsbanden 2026 per leveringsmodel.

Veelgestelde vragen

Hoe lang moet een AI-agentpilot duren?

Dertig tot negentig dagen. Korter dan 30 en u meet nieuwigheid. Langer dan 90 zonder besluit en de pilot is het project geworden, precies het faalpatroon dat de annuleringsdata van Gartner beschrijven.

Moet een AI-agentpilot betaald zijn?

Ja. Gratis pilots krijgen de restcapaciteit van beide kanten en worden tegen niets afgezet, dus ze eindigen in een demo en het besluit valt nooit. Een betaalde, afgebakende pilot tegen de prijs van één workflow krijgt echte mensen en een echte succesmaatstaf.

Wat is een redelijke stopdrempel?

Ongeveer de helft tot twee derde van de doelmaatstaf: hoog genoeg dat missen duidelijk betekent dat de workflow niet klaar is, en laag genoeg om één trage week te overleven. Het exacte getal telt minder dan het feit dat het op schrift staat en dat iemand is benoemd om de knoop door te hakken.

Wie moet intern eigenaar van de pilot zijn?

Eén persoon die vandaag eigenaar van de workflow is, geen commissie en niet de AI-enthousiast. Die kent de uitzonderingen, kan beoordelen of een output klopt en zal eerlijk zijn over de vraag of de uren echt terugkwamen.

Welke vragen stellen we de leverancier voordat dit begint?

De volledige lijst staat in 24 vragen voor een leverancier van AI-agents. Twijfelt u nog of u überhaupt een leverancier inschakelt, begin dan met zelf bouwen of kopen.

Doe er een met ons

We bakenen pilots precies zo af: één workflow, vaste prijs, schriftelijke succesmaatstaf, overeengekomen stopdrempel, security vooraf beantwoord. Boek een growth-audit en we benoemen uw workflow met de meeste waarde, of lees hoe AI-agentontwikkeling hier werkt.

Praat met ons

Spreek met het team dat het zou runnen

Vertel ons waar we moeten kijken en we antwoorden binnen 24 uur met het startpunt. Geen pitch tot u de waarde ziet.

Teegan neemt per e-mail contact op over je aanvraag. Afmelden kan altijd. Privacy

Liever eerst spreken? Boek een gesprek van 30 minuten.

Voeg ons toe als voorkeursbron op Google

Een gratis Google-instelling om meer van onze relevante artikelen in uw zoekervaring te zien. U kunt dit altijd wijzigen.

Wilt u dat wij dit voor u doen?

Boek een gratis consult van 30 minuten. Geen pitch tot u de waarde ziet.

Groeiconsult boeken → Beoordeling 5,0 op Clutch