AI-agenten in bedrijven
Wat een AI-agent nodig heeft om in een bedrijf te werken
Door Julián Medina · Directeur van SourcingUp en maker van CommerceUp
Een agent kan deelnemen aan het werk van een bedrijf als het beschikt over een gedefinieerde taak, zakelijke context, de nodige hulpmiddelen en duidelijke grenzen. Onze ervaring leert dat continuïteit en menselijke beoordeling de kwaliteit veranderen van wat u kunt bijdragen.
Het verschil verschijnt wanneer u het proces betreedt
In ThinkUp vertelde ik hoe meneer Anderson binnen ons engineeringproces aan de slag ging: met Discord, Jira en kennis van de beslissingen die we namen. Wat voor mij relevant was, was dat hij zichzelf in het systeem kon vinden en kon begrijpen hoe we werkten.
Dat verhaal is mijn eigen ervaring bij SourcingUp en CommerceUp. Het betekent niet dat elke agent hetzelfde kan doen in een andere organisatie, noch dat een demonstratie gelijk staat aan een opgeloste operatie.
Vier voorwaarden die moeten worden gedefinieerd
- Een verifieerbare taak. Het oplossen van een ticket heeft een duidelijkere reikwijdte dan een opdracht als het verbeteren van het bedrijf. Er moet een manier zijn om te herkennen of het werk goed is gelukt.
- Context die kan worden hersteld. Regels, eerdere beslissingen en documentatie helpen bij het interpreteren van wat er wordt gevraagd. Het is ook noodzakelijk om te onderscheiden welke informatie nog geldig is.
- Geschikte tools en machtigingen. Documentatie lezen en een systeem aanpassen zijn verschillende handelingen. Toegang moet reageren op wat de taak vereist.
- Een vorm van recensie. U moet beslissen wie het resultaat controleert en wat er gebeurt als er informatie ontbreekt of er een fout optreedt.
Wat verandert er bij continuïteit?
Een deel van de taak van een bedrijf is het onthouden waarom iets op een bepaalde manier is gedaan. Wanneer die context beschikbaar is, kunnen we evalueren of de agent de beperkingen respecteert en voordeel haalt uit eerdere beslissingen. Ook kunnen wij detecteren wanneer documentatie correctie behoeft.
In die editie telde ik een test van ruim 35 uur uitvoering. Het was een observatie van ons werk, geen algemene maatstaf of een belofte van autonomie. Om een agent te beoordelen, ben ik geïnteresseerd in wat hij heeft opgelost en hoeveel werk hij voor het team heeft achtergelaten, naast de tijd die hij aan het werk was.
Waar zou u naar kijken voordat u uw bereik uitbreidt?
Ik zou voltooide taken, fouten, menselijke tussenkomsten en herbewerkingen beoordelen. Ik zou ook testen wat er gebeurt als je een onvolledige instructie of een falend hulpmiddel tegenkomt. Als we hun daden niet kunnen reconstrueren, zal het moeilijk voor ons zijn om het proces te corrigeren.
Autonomie wordt gedefinieerd door taak. Het team kan u toestaan een voorstel voor te bereiden en te laten beoordelen voordat u het implementeert. Die grens moet in het werksysteem zitten en moet bovendien in een instructie zijn vastgelegd.
Begin met een deel van het werk
Voor een bedrijf dat net begint, geef ik de voorkeur aan een beperkte flow, geïdentificeerde bronnen en een verantwoordelijke persoon. Met die basis kun je leren wat een agent bijdraagt en wat het team nog nodig heeft. Als het eerste proces nog steeds niet duidelijk is, heb ik er een criterium voor achtergelaten begin met AI vanuit een specifiek probleem.
Waar komt deze blik vandaan?
Ervaring gerapporteerd in April 2026 ThinkUp: het gebeurt al. De voorwaarden en evaluatiecriteria van deze gids ontwikkelen dat perspectief; Ze presenteren geen nieuwe klantstatistieken.