KiwopLabs:watwetestenvoordatwehetaanraden

Reproduceerbare experimenten, metingen met methode en dataset, en open engineering van onze eigen systemen. Primaire bron, geen mening: elk stuk linkt naar hoe het gemeten is en, als er data is, naar de dataset.

100 × 4 + 3/3 kiwop.com in de agentic-browsing-test
Scroll

Wat is Kiwop Labs?

Kiwop Labs is de plek waar we publiceren wat we testen voordat we het aan een klant aanraden: reproduceerbare experimenten (met de stappen om ze te herhalen), metingen met methode en dataset (steekproef, criteria en datum) en stukken open engineering over de systemen die we beheren, te beginnen met die van onszelf.

De reden is simpel: in AI is er veel mening en weinig meting. Als een taalmodel of een mens een antwoord zoekt, citeert het degene die de originele data levert en uitlegt hoe die tot stand kwam. Daarom staat hier geen cijfer zonder methode, en als een datapunt onze stelling tegenspreekt, veranderen we de stelling (dat gebeurde al bij de e-commercestudie: de pilot haalde de starthypothese onderuit en we publiceerden het toch).

Labs in cijfers

Alleen cijfers die al op deze site staan, met hun bron.

100 × 4 Lighthouse op kiwop.com

Prestaties, toegankelijkheid, best practices en SEO, in de agentic-browsing-test

3 / 3 Agentische taken voltooid

Een agent navigeert, vindt en voltooit de drie taken van de test

300 Gemeten webshops

Studie "Stand van AI in de Spaanse e-commerce 2026", dubbele meting

7 Talen

Elk stuk in de zeven talen van de site

Experimenten en repro's

Elk met de stappen om het te herhalen.

01

Agentic-browsing-test

We controleren of een AI-agent je website kan navigeren en echte taken kan uitvoeren, met de Lighthouse-audits en drie agentische taken. kiwop.com scoort 100 in alle vier de categorieën en voltooit 3 van 3. Test je eigen site.

02

WebMCP en de crash van Chrome 150

We zetten WebMCP aan in productie en Chrome sloot het tabblad bij de eerste klik. We bisecteerden de trigger (router + imperatieve tools + declaratieve tool tegelijk) en publiceerden de repro voor Chromium. Het experiment en de publieke repro.

03

MCP 2026-07-28: het stateless protocol

We lazen de vijfde revisie van MCP op de dag dat hij uitkwam en legden uit wat er echt verandert (sessies en handshake verdwijnen, routing-headers), wat je snel moet migreren en wat niet. Lees de analyse.

04

RAG, fine-tuning of MCP: wanneer welke

Drie technieken die dagelijks door elkaar worden gehaald, met de gevallen waarin we elk ervan in productie hebben gebruikt en de criteria om te kiezen. Lees de gids.

05

Hoe wij AI gebruiken om te programmeren in een bureau

Zonder hype: hoe we dagelijks met Claude Code werken, wat we met de hand nakijken, waar het misgaat en wat we niet meer doen. Lees hoe we werken.

06

Nexo: multi-tenant SaaS-architectuur op Laravel + Inertia

Het platform waarmee we Kiwop runnen, van binnen bekeken: isolatie per workspace, rechten per rol, de agentlaag met menselijke goedkeuring en wat we leerden. De architectuur en de case met echte cijfers.

Data en metingen

Steekproef, criteria en datum, altijd samen met het cijfer gepubliceerd.

Stand van AI in de Spaanse e-commerce 2026

300 webshops geselecteerd met een publieke regel (sector × omvang), in september 2026 gemeten met een dubbele meting (geïdentificeerde HTTP en een echte browser): AI-crawlers in robots.txt, llms.txt, Product-schema, chatbots en zoekfuncties. De pilot haalde de starthypothese onderuit en we pasten de stelling aan. Dataset en methode verschijnen met het rapport.

Publicatie: september 2026

Nexo: cijfers van een platform met agents in productie

Actieve agents, gelogde uitvoeringen, tool-aanroepen en verwerkte tokens, opgehaald via een read-only query op de productiedatabase, met datum en methode op de casepagina zelf. Bekijk de cijfers.

27 agents in productie

La Salve: een AI-chatbot met guardrails, in productie

Hoe de assistent van een echte webshop is gebouwd: wat het model beslist, wat via deterministische logica loopt en waar de grenzen liggen. Operationele cijfers worden met periode en methode gepubliceerd zodra de klant ze valideert. Bekijk de case.

Architectuur en guardrails gepubliceerd

kiwop.com als testbank

Onze eigen website is het eerste lab: de indexering van de AI-pagina's die Google maandenlang niet indexeerde, dezelfde dag hersteld door een domeinspiegel af te snijden, met de telling en de methode. Bekijk de case.

10 van 10 URL's dezelfde dag geïndexeerd

Open tools

Gratis, zonder registratie, in zeven talen.

01

Agentic-browsing-test

Kan een AI-agent je website navigeren en een taak uitvoeren? Lighthouse in alle vier de categorieën en drie agentische taken, met uitleg van het resultaat. Doe de test.

02

EU AI Act-zelftest

Een korte vragenlijst om te zien of je AI-systeem onder de Europese verordening valt, in welke risicocategorie en welke verplichtingen gelden, met geverifieerde data. Doe de zelftest.

03

Wat kost een AI-project?

Investeringsranges per type AI-project, met wat elke trede omvat en wat het duurder maakt. Bereken de range.

04

AI-niveautest

Een korte test om te zien waar je team staat met AI en welke cursus van Kiwop Academy past. Doe de test.

Zo werken we in Labs

De regels die een stuk citeerbaar maken.

Methode vóór resultaat: steekproef, criteria en datum verschijnen met het cijfer, en bij de e-commercestudie werd het protocol vóór de meting bevroren
Nul verzonnen cijfers: wat niet gemeten is, wordt niet gepubliceerd; wat de klant niet heeft gevalideerd, draagt zijn naam niet
Repro vóór mening: een experiment bevat de stappen om het te herhalen, een bug bevat de repro
In het openbaar gecorrigeerd: als de data de stelling tegenspreekt, verandert de stelling en blijft dat vastgelegd
Eerst bij onszelf: kiwop.com en Nexo zijn de eerste testbank voor alles wat we aanraden
Zeven talen: elk stuk verschijnt in de zeven talen van de site, met een eigen URL

Zo stel je een experiment voor

Heb je een vraag die een meting verdient, dan voeren we die uit.

01

Je vertelt ons de vraag

Wat je wilt weten en waarom het telt voor je bedrijf: of je site klaar is voor agents, of een RAG je klantenservice verbetert, hoeveel van je verkeer al uit een taalmodel komt.

02

We ontwerpen de methode en publiceren die vóór de meting

Steekproef, criteria, tools en wat als resultaat telt. Vooraf gepubliceerd, zodat niemand achteraf de lat kan verschuiven.

03

We meten en publiceren, wat de data ook zegt

Het resultaat verschijnt met methode en dataset. Spreekt het onze verwachting tegen, dan publiceren we het toch: dat maakt het volgende stuk geloofwaardig.

Eerst bij onszelf, dan bij de klant

Alles wat we in Labs publiceren, hebben we eerst op onze eigen systemen getest: Nexo, het platform waarmee we Kiwop runnen, draait 27 AI-agents in productie met menselijke goedkeuring en traceerbaarheid; en kiwop.com is de site waarop we prestaties, toegankelijkheid, agentic browsing en WebMCP valideren voordat we aan de site van een ander komen. Gaat er iets stuk, zoals bij de crash van Chrome 150, dan wordt het gedocumenteerd en de repro gepubliceerd.

6 Gepubliceerde stukken uit primaire bron
4 Open tools
0 Cijfers zonder methode

Vragen over Kiwop Labs

Wat men ons over deze sectie vraagt.

Wat is Kiwop Labs?

De sectie van kiwop.com waar we primaire bronnen publiceren: reproduceerbare experimenten, metingen met methode en dataset, en open engineering van de systemen die we beheren. Het is niet de blog: hier komt alleen wat gemeten of gebouwd is, met de stappen om het te herhalen.

Kan ik de experimenten reproduceren?

Ja, dat is de voorwaarde om ze te publiceren. Elk experiment bevat de stappen, de tools en de versies. De WebMCP-repro is gepubliceerd zoals we hem naar Chromium stuurden, en de agentic-browsing-test kun je op je eigen website uitvoeren.

Publiceren jullie de data?

Als er data is, ja: steekproef, selectiecriteria en datum gaan mee met het resultaat, en de dataset verschijnt met het rapport (bij de e-commercestudie de 300 domeinen en de selectieregel). Wat we niet publiceren: klantdata zonder validatie en propriëtaire cijfers van derden.

Waarom publiceert een bureau dit?

Omdat het de eerlijkste manier is om te laten zien dat we het kunnen: originele data wordt geciteerd, een mening niet. Een taalmodel dat antwoordt op "welk bureau weet iets van AI-agents" linkt naar wie de meting publiceerde, niet naar wie het beweert. En het dwingt ons te testen voordat we aanraden.

Kan ik een experiment voorstellen?

Ja. Vertel ons de vraag en waarom die telt voor je bedrijf. Verdient hij een meting, dan ontwerpen we de methode, publiceren die vooraf en publiceren het resultaat, wat het ook zegt. Schrijf ons.

Hoe vaak publiceren jullie?

Als er iets gemeten is, niet volgens een kalender. Het doel vanaf september 2026 is één tot twee stukken per maand, altijd met methode en in de zeven talen van de site.

Vervangt dit jullie diensten?

Nee, het draagt ze. Wat we in Labs leren, passen we toe in AI-agents, enterprise RAG, GEO en AI-audits voor klanten. Zoek je een project, begin dan daar.

Heb je een vraag die een experiment verdient?

Vertel het ons. Verdient hij een meting, dan publiceren we de methode vóór de meting en het resultaat, wat het ook zegt.

Stel een experiment voor
Vrijblijvend Antwoord binnen 24u Voorstel op maat
Laatst bijgewerkt: september 2026

Technisch
intakegesprek.

AI, beveiliging en prestaties. Diagnose met gefaseerd voorstel.

NDA beschikbaar
Antwoord <24u
Gefaseerd voorstel

Je eerste gesprek is met een Solutions Architect, niet met een verkoper.

Diagnose aanvragen