Bovenaan een overzicht staat een datum: "data van maandag 08:14". Voor wie het platform voor het eerst gebruikt, roept dat een vraag op die zelden hardop gesteld wordt: wat gebeurt er precies tussen dat moment en het cijfer dat nu op het scherm staat. Het antwoord is geen mysterieuze zwarte doos, maar een keten met een aantal vaste, uit te leggen stappen.

De planning

Elk project heeft per kanaal — Prompts, Socials, Keywords, Web — een moment waarop de volgende scan gepland staat. Elke minuut wordt gekeken welke projecten aan de beurt zijn: is het geplande moment voor een kanaal bereikt, dan start de scan voor dat kanaal. Dat is een bewuste keuze voor een regelmatige, voorspelbare cadans per project, in plaats van een systeem dat continu en ongepland draait. Een scan is in de woordenschat van het platform dan ook precies dat: één geplande meting voor één kanaal van één project, niet een doorlopende stroom.

Het ophalen

Zodra een scan start, hangt het per kanaal af wat er precies opgehaald wordt. Voor Socials en Web betekent dit een crawl: een run die pagina's of posts van een externe bron verzamelt, bijvoorbeeld de posts van een social-account of de pagina's achter een sitemap. Voor Prompts en Keywords gaat het om een bevraging van een externe bron — een AI-provider die een promptantwoord genereert, of een zoekresultatenpagina die wordt opgehaald. Een scan kan dus een crawl starten, maar de twee zijn niet hetzelfde: een scan is het geplande moment, een crawl is de daadwerkelijke ophaalactie die daaruit kan volgen. Wat het verschil tussen beide termen precies inhoudt, staat verder uitgelegd in Wat is een scan, en wat is een crawl?.

De analyse

Wat binnenkomt, is nog geen bruikbaar cijfer. Een promptantwoord of een social post is ruwe tekst, en die tekst doorloopt een analyse die sentiment, onderwerpen en genoemde merken eruit haalt. Die analyse levert een gestructureerd antwoord op, en sinds release 1.3.0 wordt dat antwoord gevalideerd tegen het schema dat ervoor is opgevraagd. Eerder kon een antwoord dat wel parste maar een verplicht veld miste, alsnog tot een stille fout in de interface leiden; sinds deze release wordt zo'n antwoord afgewezen, gaat de achtergrondjob opnieuw in de wachtrij en wordt het incident vastgelegd voor opvolging. Dat gebeurt niet oneindig: een betaalde poging die al kosten heeft veroorzaakt, wordt hooguit een beperkt aantal keer opnieuw geprobeerd, in plaats van eindeloos herhaald op kosten van het platform. De reden daarachter is eenvoudig: een generatie die al is afgerekend bij een aanbieder, blijft geld kosten bij elke nieuwe poging, dus een fout die telkens dezelfde reden heeft, moet op een gegeven moment stoppen in plaats van blind door te draaien.

Het cijfer

Pas nadat de analyse geslaagd is, wordt het resultaat opgeslagen en verschijnt het cijfer op uw scherm: een vermelding op het Prompts-overzicht, een positie in de Keyword Monitor, een wijziging in Web. Bij die opslag hoort ook de freshness-stempel: het moment van deze scan en het moment waarop de volgende gepland staat, zodat u op elk overzicht kunt zien hoe oud de data is die u bekijkt.

Wat er gebeurt als iets misgaat

Niet elke scan verloopt zonder problemen: een externe bron kan traag reageren, een provider kan tijdelijk overbelast zijn, of een antwoord kan niet aan het verwachte format voldoen. Het platform kiest er bewust voor om zulke fouten zichtbaar te maken in plaats van ze stil te negeren: een storing wordt gelogd en, waar nodig, opnieuw geprobeerd binnen een vast bepaald budget, in plaats van ongemerkt weggevallen te zijn. Die keuze staat niet op zichzelf: het platform werkt overal volgens hetzelfde uitgangspunt dat een falende stap zichtbaar moet blijven, nooit stilletjes verdwijnen. Voor u als gebruiker betekent dat concreet dat een leeg of ongewijzigd overzicht met een oude freshness-datum eerder wijst op een storing die wordt opgevolgd, dan op een systeem dat u zonder waarschuwing verouderde data voorschotelt.

Waarom deze keten precies zo is opgebouwd

De hele keten — planning, ophalen, analyse, cijfer — bestaat uit stappen die elk hun eigen verantwoordelijkheid dragen en elk hun eigen manier hebben om te falen. Een planning die per minuut controleert wat aan de beurt is, zorgt ervoor dat elk project op zijn eigen ritme gemeten wordt zonder dat het ene project op het andere hoeft te wachten. Het scheiden van ophalen en analyseren betekent dat een probleem in de tekstanalyse niet meteen ook de ruwe data verliest: die staat al veilig, en alleen de verwerking ervan wordt opnieuw geprobeerd. Deze opbouw in losse stappen is precies waarom een storing in één onderdeel zichtbaar en herstelbaar blijft, in plaats van de hele keten in één keer te laten vastlopen.

Wat u nu kunt doen

  • Lees de freshness-stempel bij een overzicht als het antwoord op de vraag "hoe recent is dit", niet als een garantie dat er niets veranderd is; wat freshness precies betekent, staat uitgelegd in Wat is freshness en waarom staat er "data van"?.
  • Onthoud het onderscheid tussen scan en crawl wanneer u leest waarom een overzicht op een bepaald moment ververst.
  • Behandel een lang ongewijzigd overzicht als een signaal om de freshness-datum te controleren, niet als bewijs dat er niets gebeurt.

Wilt u zien hoe deze keten er in een lopend project uitziet, van scanmoment tot cijfer op uw scherm? Vraag een demo aan.