Kiwop Labs: wat we testen voordat we het aanraden

Reproduceerbare experimenten, metingen met methode en dataset, en open engineering van onze eigen systemen. Primaire bron, geen mening: elk stuk linkt naar hoe het gemeten is en, als er data is, naar de dataset.

  • 100 × 4 + 3/3 kiwop.com in de agentic-browsing-test
Scroll

Definitie

Wat is Kiwop Labs?

Kiwop Labs is de plek waar we publiceren wat we testen voordat we het aan een klant aanraden: reproduceerbare experimenten (met de stappen om ze te herhalen), metingen met methode en dataset (steekproef, criteria en datum) en stukken open engineering over de systemen die we beheren, te beginnen met die van onszelf.

De reden is simpel: in AI is er veel mening en weinig meting. Als een taalmodel of een mens een antwoord zoekt, citeert het degene die de originele data levert en uitlegt hoe die tot stand kwam. Daarom staat hier geen cijfer zonder methode, en als een datapunt onze stelling tegenspreekt, veranderen we de stelling (dat gebeurde al bij de e-commercestudie: de pilot haalde de starthypothese onderuit en we publiceerden het toch).

In cijfers

Labs in cijfers

Alleen cijfers die al op deze site staan, met hun bron.

  • 100 × 4 Lighthouse op kiwop.com Prestaties, toegankelijkheid, best practices en SEO, in de agentic-browsing-test
  • 3 / 3 Agentische taken voltooid Een agent navigeert, vindt en voltooit de drie taken van de test
  • 300 Gemeten webshops Studie "Stand van AI in de Spaanse e-commerce 2026", dubbele meting
  • 7 Talen Elk stuk in de zeven talen van de site

Kernpunten

Experimenten en repro's

Elk met de stappen om het te herhalen.

  1. 01

    Agentic-browsing-test

    We controleren of een AI-agent je website kan navigeren en echte taken kan uitvoeren, met de Lighthouse-audits en drie agentische taken. kiwop.com scoort 100 in alle vier de categorieën en voltooit 3 van 3. Test je eigen site.

  2. 02

    WebMCP en de crash van Chrome 150

    We zetten WebMCP aan in productie en Chrome sloot het tabblad bij de eerste klik. We bisecteerden de trigger (router + imperatieve tools + declaratieve tool tegelijk) en publiceerden de repro voor Chromium. Het experiment en de publieke repro.

  3. 03

    MCP 2026-07-28: het stateless protocol

    We lazen de vijfde revisie van MCP op de dag dat hij uitkwam en legden uit wat er echt verandert (sessies en handshake verdwijnen, routing-headers), wat je snel moet migreren en wat niet. Lees de analyse.

  4. 04

    RAG, fine-tuning of MCP: wanneer welke

    Drie technieken die dagelijks door elkaar worden gehaald, met de gevallen waarin we elk ervan in productie hebben gebruikt en de criteria om te kiezen. Lees de gids.

  5. 05

    Hoe wij AI gebruiken om te programmeren in een bureau

    Zonder hype: hoe we dagelijks met Claude Code werken, wat we met de hand nakijken, waar het misgaat en wat we niet meer doen. Lees hoe we werken.

  6. 06

    Nexo: multi-tenant SaaS-architectuur op Laravel + Inertia

    Het platform waarmee we Kiwop runnen, van binnen bekeken: isolatie per workspace, rechten per rol, de agentlaag met menselijke goedkeuring en wat we leerden. De architectuur en de case met echte cijfers.

Toepassingen

Data en metingen

Steekproef, criteria en datum, altijd samen met het cijfer gepubliceerd.

  • GEO-baseline: welke bureaus LLM's in Spanje noemen

    Elke maand stellen we 40 koopvragen (15 uit de ranking van marketingdirecto, letterlijk overgenomen, 15 eigen vragen over AI-bureaus en 10 met wat mensen assistenten echt vragen) aan assistenten met webzoeken en publiceren we welke bureaus ze aanbevelen, welke domeinen ze citeren en waar Kiwop verschijnt, met de volledige antwoorden. Bekijk de reeks.

    Maandelijkse reeks, open dataset

  • Wat Spanje de AI vraagt, tegenover Google

    Elke maand: hoeveel vragen AI-assistenten en Google krijgen voor 60 termen over bureaus, prijzen en AI voor bedrijven. Prijsvragen gaan al eerst naar de AI; lokaal blijft bij Google. Bekijk de reeks.

    Maandelijks, open dataset

  • Stand van AI in de Spaanse e-commerce 2026

    300 webshops geselecteerd met een publieke regel (sector × omvang), in september 2026 gemeten met een dubbele meting (geïdentificeerde HTTP en een echte browser): AI-crawlers in robots.txt, llms.txt, Product-schema, chatbots en zoekfuncties. De pilot haalde de starthypothese onderuit en we pasten de stelling aan. Dataset en methode verschijnen met het rapport. Lees het rapport.

    Gepubliceerd: 300 webshops, open dataset

  • Ranking van AI-bureaus op basis van bewijs

    Elke maand tellen we in hoeveel antwoorden van ChatGPT, Claude, Gemini en Perplexity elk Spaans AI-, GEO- en marketingbureau voorkomt, met de volledige antwoorden en de geciteerde domeinen. Kiwop staat waar het staat, en dat zeggen we ook. Bekijk de ranking.

    Maandelijks, automatisch herberekend

  • Gepubliceerde prijzen van digitale diensten in Spanje

    Elk kwartaal gaan we terug naar de tariefpagina's van Spaanse bureaus en freelancers en controleren we of de prijs die ze publiceren er nog staat: website, webshop, SEO, onderhoud, ontwikkeluur, AI, chatbots, GEO en Ads. Alleen prijzen die de aanbieder zelf publiceert, met letterlijke tekst en URL; Kiwop staat op de lijst en telt als ieder ander. Bekijk het observatorium.

    Elk kwartaal, open dataset

  • AI-agenten in productie: de telemetrie van Nexo, elk kwartaal

    Runs en fouten van de agenten, voorstellen die een mens ondertekent of verwerpt, PR's van de autonome worker, geclassificeerde e-mail en kosten via API en via abonnement. Alleen-lezen aggregaten van het platform waarmee Kiwop werkt, zonder namen of teksten. Bekijk de reeks.

    Per kwartaal, open SQL-query

  • Nexo: cijfers van een platform met agents in productie

    Actieve agents, gelogde uitvoeringen, tool-aanroepen en verwerkte tokens, opgehaald via een read-only query op de productiedatabase, met datum en methode op de casepagina zelf. Bekijk de cijfers.

    27 agents in productie

  • La Salve: een AI-chatbot met guardrails, in productie

    Hoe de assistent van een echte webshop is gebouwd: wat het model beslist, wat via deterministische logica loopt en waar de grenzen liggen. Operationele cijfers worden met periode en methode gepubliceerd zodra de klant ze valideert. Bekijk de case.

    Architectuur en guardrails gepubliceerd

  • kiwop.com als testbank

    Onze eigen website is het eerste lab: de indexering van de AI-pagina's die Google maandenlang niet indexeerde, dezelfde dag hersteld door een domeinspiegel af te snijden, met de telling en de methode. Bekijk de case.

    10 van 10 URL's dezelfde dag geïndexeerd

Kernpunten

Open tools

Gratis, zonder registratie, in zeven talen.

  1. 01

    Agentic-browsing-test

    Kan een AI-agent je website navigeren en een taak uitvoeren? Lighthouse in alle vier de categorieën en drie agentische taken, met uitleg van het resultaat. Doe de test.

  2. 02

    EU AI Act-zelftest

    Een korte vragenlijst om te zien of je AI-systeem onder de Europese verordening valt, in welke risicocategorie en welke verplichtingen gelden, met geverifieerde data. Doe de zelftest.

  3. 03

    Wat kost een AI-project?

    Investeringsranges per type AI-project, met wat elke trede omvat en wat het duurder maakt. Bereken de range.

  4. 04

    AI-niveautest

    Een korte test om te zien waar je team staat met AI en welke cursus van Kiwop Academy past. Doe de test.

  5. 05

    Is je webshop klaar voor AI?

    Typ het domein van een webshop en binnen een minuut heb je een openbaar rapport met wat een AI-assistent ziet: of hij binnenkomt, of er een echte llms.txt is en of de productpagina prijs en voorraad toont. Dezelfde methode als het onderzoek onder 300 webshops. Een webshop controleren.

Wat is inbegrepen

Zo werken we in Labs

De regels die een stuk citeerbaar maken.

  • Methode vóór resultaat: steekproef, criteria en datum verschijnen met het cijfer, en bij de e-commercestudie werd het protocol vóór de meting bevroren
  • Nul verzonnen cijfers: wat niet gemeten is, wordt niet gepubliceerd; wat de klant niet heeft gevalideerd, draagt zijn naam niet
  • Repro vóór mening: een experiment bevat de stappen om het te herhalen, een bug bevat de repro
  • In het openbaar gecorrigeerd: als de data de stelling tegenspreekt, verandert de stelling en blijft dat vastgelegd
  • Eerst bij onszelf: kiwop.com en Nexo zijn de eerste testbank voor alles wat we aanraden
  • Zeven talen: elk stuk verschijnt in de zeven talen van de site, met een eigen URL

Zo werken wij

Zo stel je een experiment voor

Heb je een vraag die een meting verdient, dan voeren we die uit.

  1. 01

    Je vertelt ons de vraag

    Wat je wilt weten en waarom het telt voor je bedrijf: of je site klaar is voor agents, of een RAG je klantenservice verbetert, hoeveel van je verkeer al uit een taalmodel komt.

    Eén gesprek
  2. 02

    We ontwerpen de methode en publiceren die vóór de meting

    Steekproef, criteria, tools en wat als resultaat telt. Vooraf gepubliceerd, zodat niemand achteraf de lat kan verschuiven.

    Eén week
  3. 03

    We meten en publiceren, wat de data ook zegt

    Het resultaat verschijnt met methode en dataset. Spreekt het onze verwachting tegen, dan publiceren we het toch: dat maakt het volgende stuk geloofwaardig.

    Afhankelijk van het experiment

Het bewijs

Eerst bij onszelf, dan bij de klant

Alles wat we in Labs publiceren, hebben we eerst op onze eigen systemen getest: Nexo, het platform waarmee we Kiwop runnen, draait 27 AI-agents in productie met menselijke goedkeuring en traceerbaarheid; en kiwop.com is de site waarop we prestaties, toegankelijkheid, agentic browsing en WebMCP valideren voordat we aan de site van een ander komen. Gaat er iets stuk, zoals bij de crash van Chrome 150, dan wordt het gedocumenteerd en de repro gepubliceerd.

  • 8 Gepubliceerde stukken uit primaire bron
  • 5 Open tools
  • 0 Cijfers zonder methode

Veelgestelde vragen

Vragen over Kiwop Labs

Wat men ons over deze sectie vraagt.

Wat is Kiwop Labs?

De sectie van kiwop.com waar we primaire bronnen publiceren: reproduceerbare experimenten, metingen met methode en dataset, en open engineering van de systemen die we beheren. Het is niet de blog: hier komt alleen wat gemeten of gebouwd is, met de stappen om het te herhalen.

Kan ik de experimenten reproduceren?

Ja, dat is de voorwaarde om ze te publiceren. Elk experiment bevat de stappen, de tools en de versies. De WebMCP-repro is gepubliceerd zoals we hem naar Chromium stuurden, en de agentic-browsing-test kun je op je eigen website uitvoeren.

Publiceren jullie de data?

Als er data is, ja: steekproef, selectiecriteria en datum gaan mee met het resultaat, en de dataset verschijnt met het rapport (bij de e-commercestudie de 300 domeinen en de selectieregel). Wat we niet publiceren: klantdata zonder validatie en propriëtaire cijfers van derden.

Waarom publiceert een bureau dit?

Omdat het de eerlijkste manier is om te laten zien dat we het kunnen: originele data wordt geciteerd, een mening niet. Een taalmodel dat antwoordt op "welk bureau weet iets van AI-agents" linkt naar wie de meting publiceerde, niet naar wie het beweert. En het dwingt ons te testen voordat we aanraden.

Kan ik een experiment voorstellen?

Ja. Vertel ons de vraag en waarom die telt voor je bedrijf. Verdient hij een meting, dan ontwerpen we de methode, publiceren die vooraf en publiceren het resultaat, wat het ook zegt. Schrijf ons.

Hoe vaak publiceren jullie?

Als er iets gemeten is, niet volgens een kalender. Het doel vanaf september 2026 is één tot twee stukken per maand, altijd met methode en in de zeven talen van de site.

Vervangt dit jullie diensten?

Nee, het draagt ze. Wat we in Labs leren, passen we toe in AI-agents, enterprise RAG, GEO en AI-audits voor klanten. Zoek je een project, begin dan daar.

Volgende stap

Heb je een vraag die een experiment verdient?

Vertel het ons. Verdient hij een meting, dan publiceren we de methode vóór de meting en het resultaat, wat het ook zegt.

  • Vrijblijvend
  • Antwoord binnen 24u
  • Voorstel op maat
Laatst bijgewerkt: september 2026

Laten we praten.

Technisch intakegesprek

AI, beveiliging en prestaties. Diagnose met gefaseerd voorstel.

  • NDA beschikbaar
  • Antwoord <24u
  • Gefaseerd voorstel

Je eerste gesprek is met een Solutions Architect, niet met een verkoper.

Diagnose aanvragen