Waarom je een spec schrijft voordat je een agent bouwt
Een AI-agent voert namens mensen acties uit in je systemen. Voordat het bouwen begint, heeft het team een gedeeld, uitgeschreven antwoord nodig op een paar vragen: welk proces de agent uitvoert, waar hij aan mag komen, wie zijn werk goedkeurt, hoe je weet dat hij het goed doet en hoe je hem uitzet. Die antwoorden staan in de spec.
Met een spec loopt de scope niet uit de hand. Security en juridisch hebben iets concreets om te beoordelen, en maanden later is de spec de naslag als iemand vraagt waarom de agent iets mag. Een spec legt ook vroeg gaten bloot. Kan niemand zeggen wat de agent moet doen als een leveranciersfactuur geen inkooporder heeft, dan is dat een procesvraag die je oplost voordat er code wordt geschreven.
De download, ai-agent-spec.md (Engelstalig), bevat:
- Koppen voor alle tien onderdelen, elk met een toelichting over wat je invult.
- Tabellen voor databronnen, tools, goedkeuringen, releasecriteria, alerts, risico's en wijzigingen.
- Een ingekort uitgewerkt voorbeeld voor een agent die leveranciersfacturen matcht, zodat je ziet hoeveel detail je nodig hebt.
De onderdelen van de template
| Onderdeel | Wat het beantwoordt |
|---|---|
| 1. Samenvatting en eigenaarschap | Wat de agent doet in één alinea, wie eigenaar is van de uitkomst, wie hem beheert en wat buiten de scope valt. |
| 2. Proces | De trigger, de stappen nu, de stappen met de agent en de bekende uitzonderingen. |
| 3. Input en data | Welke systemen en documenten hij leest, hoe actueel die zijn en waar persoonsgegevens meespelen. |
| 4. Tools en rechten | Elke tool die hij kan aanroepen, of die leest of schrijft, de scope en onder wiens identiteit hij draait. |
| 5. Goedkeuring en escalatie | Welke acties een mens nodig hebben, wie die persoon is, wat die ziet en wat er gebeurt als niemand reageert. |
| 6. Output en definitie van klaar | Wat de agent oplevert, in welk formaat, en hoe iemand dat controleert. |
| 7. Evals en succescriteria | De testset, de drempels voor een release en wat je na de livegang meet. |
| 8. Monitoring en rollback | Logs, alerts, de noodstop en de weg terug naar het handmatige proces. |
| 9. Risico's en open vragen | Bekende manieren waarop het misgaat en besluiten die nog genomen moeten worden. |
| 10. Wijzigingslog | Wat er veranderde, wanneer, welke versie van de testset het haalde en wie het goedkeurde. |
De volgorde doet ertoe. Onderdeel 2 tot en met 5 beschrijven de taak en de grenzen ervan. De proceseigenaar gaat daarmee akkoord voordat je 6 tot en met 8 schrijft, want drempels en alerts zijn pas zinvol als de scope vastligt. Wees eerlijk in onderdeel 9: een open vraag die is opgeschreven, krijgt een eigenaar.