Template voor een AI-agentspecificatie: leg proces, tools en goedkeuringen vast

Voor elke agent schrijven we een spec, nog voordat iemand een prompt schrijft. Deze template geeft je de onderdelen die wij gebruiken, met uitleg per onderdeel en een kort uitgewerkt voorbeeld.

Waarom je een spec schrijft voordat je een agent bouwt

Een AI-agent voert namens mensen acties uit in je systemen. Voordat het bouwen begint, heeft het team een gedeeld, uitgeschreven antwoord nodig op een paar vragen: welk proces de agent uitvoert, waar hij aan mag komen, wie zijn werk goedkeurt, hoe je weet dat hij het goed doet en hoe je hem uitzet. Die antwoorden staan in de spec.

Met een spec loopt de scope niet uit de hand. Security en juridisch hebben iets concreets om te beoordelen, en maanden later is de spec de naslag als iemand vraagt waarom de agent iets mag. Een spec legt ook vroeg gaten bloot. Kan niemand zeggen wat de agent moet doen als een leveranciersfactuur geen inkooporder heeft, dan is dat een procesvraag die je oplost voordat er code wordt geschreven.

De download, ai-agent-spec.md (Engelstalig), bevat:

  • Koppen voor alle tien onderdelen, elk met een toelichting over wat je invult.
  • Tabellen voor databronnen, tools, goedkeuringen, releasecriteria, alerts, risico's en wijzigingen.
  • Een ingekort uitgewerkt voorbeeld voor een agent die leveranciersfacturen matcht, zodat je ziet hoeveel detail je nodig hebt.

De onderdelen van de template

OnderdeelWat het beantwoordt
1. Samenvatting en eigenaarschapWat de agent doet in één alinea, wie eigenaar is van de uitkomst, wie hem beheert en wat buiten de scope valt.
2. ProcesDe trigger, de stappen nu, de stappen met de agent en de bekende uitzonderingen.
3. Input en dataWelke systemen en documenten hij leest, hoe actueel die zijn en waar persoonsgegevens meespelen.
4. Tools en rechtenElke tool die hij kan aanroepen, of die leest of schrijft, de scope en onder wiens identiteit hij draait.
5. Goedkeuring en escalatieWelke acties een mens nodig hebben, wie die persoon is, wat die ziet en wat er gebeurt als niemand reageert.
6. Output en definitie van klaarWat de agent oplevert, in welk formaat, en hoe iemand dat controleert.
7. Evals en succescriteriaDe testset, de drempels voor een release en wat je na de livegang meet.
8. Monitoring en rollbackLogs, alerts, de noodstop en de weg terug naar het handmatige proces.
9. Risico's en open vragenBekende manieren waarop het misgaat en besluiten die nog genomen moeten worden.
10. WijzigingslogWat er veranderde, wanneer, welke versie van de testset het haalde en wie het goedkeurde.

De volgorde doet ertoe. Onderdeel 2 tot en met 5 beschrijven de taak en de grenzen ervan. De proceseigenaar gaat daarmee akkoord voordat je 6 tot en met 8 schrijft, want drempels en alerts zijn pas zinvol als de scope vastligt. Wees eerlijk in onderdeel 9: een open vraag die is opgeschreven, krijgt een eigenaar.

Werk samen met Vantion.