Wat gebeurt er als een collega de hele dag vragen aan de assistent stelt? Voor een koper die AI in een platform ziet, is dat een logische zorg: waar posities en verkeer een bekend, begrensd kostenpatroon hebben, voelt AI-verbruik minder voorspelbaar. Een platform dat AI inzet, moet daarom niet alleen weten wat het uitgeeft, maar ook een grens hebben die voorkomt dat één gebruiker of één project de rest raakt.

Twee soorten AI-werk

Binnen GripIQ bestaan er twee verschillende vormen van AI-werk, en ze worden ook verschillend bijgehouden. De eerste vorm zijn achtergrondagents: processen die op de achtergrond draaien, zoals het analyseren van promptantwoorden op sentiment en merken, of het genereren van de wekelijkse inzichten. Voor dat soort werk is de kostprijs per opdracht exact bekend, omdat het antwoord in zijn geheel binnenkomt voor het verwerkt wordt en de kosten rechtstreeks uit het antwoord van de AI-leverancier worden gelezen.

De tweede vorm is de assistent waarmee u zelf in gesprek gaat op een projectpagina. Die assistent streamt zijn antwoord: de tekst verschijnt terwijl ze geschreven wordt, zodat u niet hoeft te wachten op een volledig antwoord voor u de eerste woorden ziet. Dat verschil in werkwijze heeft gevolgen voor hoe kosten gemeten worden. Bij een gestreamd antwoord is de exacte prijs pas beschikbaar op het moment dat het antwoord volledig is, terwijl het aantal gebruikte tokens al eerder en betrouwbaarder vaststaat. Een gesprek met de assistent wordt daarom per gesprek gemeten, in plaats van per losse vraag.

Waarom de assistent in tokens begrensd is

Tokens zijn de eenheid waarin een taalmodel tekst verwerkt, ruwweg stukjes van een woord. Voor de assistent in GripIQ is gekozen om het verbruik te begrenzen in tokens, niet in een geldbedrag. De reden is nuchter: het aantal tokens dat een gesprek verbruikt heeft, is exact en meteen beschikbaar zodra het antwoord binnenkomt, terwijl het bijbehorende geldbedrag een aparte registratie vergt die niet in elke situatie op hetzelfde moment beschikbaar is. Een limiet die op tokens rekent, kan dus zonder vertraging en zonder extra stap worden gecontroleerd, terwijl het geldbedrag apart wordt vastgelegd voor de projectadministratie.

Dat onderscheid tussen "waarop de limiet rekent" en "wat er uiteindelijk geregistreerd wordt" is bewust. Het platform houdt de werkelijke kosten van AI-verbruik per project bij, dagelijks samengevoegd, zodat er voor elk project een actueel beeld bestaat van wat er is uitgegeven. De limiet zelf grijpt in op basis van tokens, per abonnementsniveau ingesteld, zodat gebruikers niet hoeven te wachten op een kostenberekening voor ze weten of ze nog verder kunnen.

Wat er gebeurt bij de limiet

Bereikt een project de dagelijkse limiet, dan stopt alleen de assistent, en alleen voor die dag. Prompts, Keywords, Socials en Web blijven gewoon doordraaien: scans lopen volgens hun eigen schema, inzichten worden gegenereerd, rapportages blijven bijgewerkt. De volgende dag werkt de assistent gewoon weer verder, zonder dat er iets hersteld hoeft te worden. Die keuze volgt rechtstreeks uit hoe het platform is opgebouwd: een limiet op één functie mag nooit een andere functie raken, en een grens die per project geldt, beschermt bovendien de andere projecten op het platform tegen het verbruik van één druk project.

Dat een limiet per dag reset in plaats van permanent te blokkeren, is ook een bewuste keuze. Een assistent die na één te drukke dag wekenlang uitgeschakeld blijft, zou meer schade aanrichten dan het verbruik dat hij probeerde te beperken. De dagelijkse reset houdt de grens voorspelbaar zonder onnodig streng te zijn.

Waarom een betaalde poging niet eindeloos herhaald wordt

Niet elke onderbreking tijdens een AI-generatie betekent hetzelfde. Soms weigert een leverancier een verzoek omdat er tijdelijk te veel verkeer is; dat kost niets en kan zonder probleem opnieuw geprobeerd worden. Soms gaat er iets mis nadat de leverancier het werk al heeft uitgevoerd en al in rekening heeft gebracht, bijvoorbeeld bij een tijdelijke storing of een antwoord dat niet aan het verwachte format voldoet. Dat onderscheid bepaalt hoe vaak een poging herhaald wordt: een gratis fout mag vaker opnieuw geprobeerd worden dan een fout die al betaald is, omdat blind herhalen van een betaalde poging de kosten zonder garantie op een beter resultaat laat oplopen. Een generatie die al in rekening is gebracht, wordt daarom hooguit twee keer opnieuw geprobeerd, terwijl een tijdelijke, kosteloze weigering vaker een nieuwe kans krijgt. Dat voorkomt dat een storing bij een leverancier zich vertaalt in een onnodig oplopende rekening voor uw project.

Deze indeling geldt overigens niet alleen voor de assistent. Alle AI-werk in het platform volgt dezelfde logica van "wat kost het al, en wat levert nog een nieuwe poging op", zodat kosten en betrouwbaarheid met dezelfde regels behandeld worden, ongeacht welk onderdeel van het platform de AI aanroept. Voor achtergrondagents, die werken met een exacte kostprijs per opdracht, geldt hetzelfde uitgangspunt: een fout die niets gekost heeft, verdient een nieuwe kans, een fout die al is afgerekend niet zonder meer.

Dat deze regels expliciet zijn vastgelegd, in plaats van per situatie ad hoc besloten, is precies waarom een koper met een vraag over onvoorspelbare kosten een concreet antwoord krijgt in plaats van een geruststelling zonder onderbouwing. De grens ligt niet bij "we houden het wel in de gaten", maar bij een limiet die per project meetelt, een reset die elke dag opnieuw begint, en een duidelijk onderscheid tussen wat gratis opnieuw geprobeerd wordt en wat niet.

Wat u nu kunt doen

Wilt u weten welk abonnementsniveau bij uw verbruik past? Vraag een demo aan.