Kiwop Labs: el que provem abans de recomanar-ho

Experiments reproduïbles, mesures amb mètode i dataset, i enginyeria en obert dels nostres propis sistemes. Font primària, no opinió: cada peça enllaça com es va mesurar i, quan hi ha dades, el dataset.

  • 100 × 4 + 3/3 kiwop.com al test d'agentic browsing
Scroll

Definició

Què és Kiwop Labs?

Kiwop Labs és el lloc on publiquem el que provem abans de recomanar-ho a un client: experiments reproduïbles (amb els passos per repetir-los), mesures amb mètode i dataset (amb la mostra, els criteris i la data) i les peces d'enginyeria en obert dels sistemes que operem, començant pels nostres.

La raó és simple: en IA hi ha molta opinió i poca mesura. Quan un model de llenguatge o una persona busca una resposta, cita qui aporta la dada original i explica com la va obtenir. Per això aquí no hi ha xifres sense mètode, i si una dada contradiu la nostra tesi, es canvia la tesi (ja va passar amb l'estudi de l'ecommerce: el pilot va tombar la hipòtesi de partida i el vam publicar igualment).

En xifres

Labs, en xifres

Només xifres ja publicades a la web, amb la seva font.

  • 100 × 4 Lighthouse a kiwop.com Rendiment, accessibilitat, bones pràctiques i SEO, al test d'agentic browsing
  • 3 / 3 Tasques agèntiques completades Un agent navega, troba i completa les tres tasques del test
  • 300 Botigues mesurades Estudi "Estat de la IA a l'ecommerce espanyol 2026", doble passada
  • 7 Idiomes Cada peça, en els set idiomes de la web

Claus

Experiments i repros

Cadascun amb els passos per repetir-lo.

  1. 01

    Test d'agentic browsing

    Comprovem si un agent d'IA pot navegar per la teva web i completar tasques reals, amb les auditories de Lighthouse i tres tasques agèntiques. kiwop.com treu 100 a les quatre categories i completa 3 de 3. Passa el test a la teva web.

  2. 02

    WebMCP i el crash de Chrome 150

    Vam activar WebMCP a producció i Chrome matava la pestanya al primer clic. Vam bisecar el disparador (router + tools imperatives + declarativa alhora) i vam publicar el repro per a Chromium. L'experiment i el repro públic.

  3. 03

    MCP 2026-07-28: el protocol sense estat

    Vam llegir la cinquena revisió de MCP el dia que va sortir i vam explicar què canvia de debò (fora sessions i handshake, capçaleres d'encaminament) i què migrar amb pressa i què no. Llegir l'anàlisi.

  4. 04

    RAG, fine-tuning o MCP: quan fer servir cadascun

    Tres tècniques que es confonen cada dia, amb els casos en què hem fet servir cadascuna en producció i els criteris per triar. Llegir la guia.

  5. 05

    Com fem servir la IA per programar en una agència

    En detall: com treballem amb Claude Code en el dia a dia, què revisem a mà, on falla i què hem deixat de fer. Llegir com treballem.

  6. 06

    Nexo: arquitectura SaaS multi-tenant en Laravel + Inertia

    La plataforma amb què governem Kiwop, oberta per dins: aïllament per workspace, permisos per rol, la capa d'agents amb aprovació humana i el que vam aprendre. L'arquitectura i el cas amb mètriques reals.

Casos d'ús

Dades i mesures

Mostra, criteris i data, sempre publicats amb la dada.

  • Baseline GEO: quines agències citen els LLM a Espanya

    Cada mes llancem 40 preguntes de compra (15 del rànquing de marketingdirecto, reproduïdes tal qual, 15 pròpies sobre agències d'IA i 10 amb el que la gent pregunta de debò als assistents) als assistents amb cerca web i publiquem quines agències recomanen, quins dominis citen i on apareix Kiwop, amb les respostes íntegres. Veure la sèrie.

    Sèrie mensual, dataset obert

  • Què es pregunta a la IA a Espanya, davant de Google

    Cada mes, quantes consultes reben els assistents d'IA i quantes Google per a 60 termes sobre agències, preus i IA per a empreses. Les preguntes de preu ja es fan més a la IA; el local segueix a Google. Veure la sèrie.

    Mensual, dataset obert

  • Estat de la IA a l'ecommerce espanyol 2026

    300 botigues seleccionades amb regla pública (sector × mida), mesurades amb doble passada (HTTP identificat i navegador real) el setembre de 2026: crawlers d'IA a robots.txt, llms.txt, schema Product, chatbots i cercadors. El pilot va tombar la hipòtesi inicial i vam canviar la tesi. Dataset i mètode es publiquen amb l'informe. Llegir l'informe.

    Publicat: 300 botigues, dataset obert

  • Rànquing d'agències d'IA per evidència

    Cada mes comptem en quantes respostes de ChatGPT, Claude, Gemini i Perplexity apareix cada agència espanyola d'IA, GEO i màrqueting, amb les respostes íntegres i els dominis que citen. Kiwop surt on surt, i ho diem. Veure el rànquing.

    Mensual, es recalcula sol

  • Preus publicats de serveis digitals a Espanya

    Cada trimestre tornem a les pàgines de tarifes d'agències i freelance d'Espanya i comprovem que el preu que publiquen segueix allà: web, botiga online, SEO, manteniment, hora de desenvolupament, IA, chatbots, GEO i Ads. Només preus publicats pel mateix proveïdor, amb text literal i URL; Kiwop és a la llista i compta com un més. Veure l'observatori.

    Trimestral, dataset obert

  • Agents d'IA en producció: la telemetria de Nexo, cada trimestre

    Execucions i errors dels agents, propostes signades o descartades per una persona, PR entregats pel worker autònom, correu classificat i cost per API i per subscripció. Agregats de només lectura de la plataforma amb què opera Kiwop, sense noms ni textos. Veure la sèrie.

    Trimestral, consulta SQL oberta

  • Nexo: mètriques d'una plataforma amb agents en producció

    Agents actius, execucions registrades, crides a eines i tokens processats, extrets per consulta de només lectura de la base de dades de producció, amb la data i el mètode a la mateixa fitxa. Veure les mètriques.

    27 agents en producció

  • La Salve: un chatbot d'IA amb guardrails, en producció

    Com està muntat l'assistent d'un ecommerce real: què decideix el model, què va per lògica determinista i quins límits té. Les mètriques d'operació es publiquen amb període i mètode quan el client les valida. Veure el cas.

    Arquitectura i guardrails publicats

  • kiwop.com com a banc de proves

    La nostra pròpia web és el primer laboratori: la indexació de les pàgines d'IA que Google portava mesos sense indexar, recuperada el mateix dia en tallar un mirall de domini, amb el cens i el mètode. Veure el cas.

    10 de 10 URLs indexades el mateix dia

Claus

Eines obertes

Gratuïtes, sense registre, en set idiomes.

  1. 01

    Test d'agentic browsing

    Pot un agent d'IA navegar per la teva web i completar una tasca? Lighthouse a les quatre categories i tres tasques agèntiques, amb el resultat explicat. Passar el test.

  2. 02

    Autodiagnòstic EU AI Act

    Un qüestionari curt per saber si el teu sistema d'IA entra al reglament europeu, en quina categoria de risc i quines obligacions t'apliquen, amb les dates verificades. Fer l'autodiagnòstic.

  3. 03

    Quant costa un projecte d'IA?

    Rangs d'inversió per tipus de projecte d'IA, amb el que inclou cada tram i el que l'encareix. Calcular el rang.

  4. 04

    Test de nivell d'IA

    Un test curt per saber en quin punt està el teu equip amb la IA i quin curs de Kiwop Academy hi encaixa. Fer el test.

  5. 05

    La teva botiga està preparada per a la IA?

    Escriu el domini d'una botiga online i en un minut tens un informe públic amb el que veu un assistent d'IA: si pot entrar, si hi ha llms.txt de veritat i si la fitxa de producte exposa preu i estoc. Mateix mètode que l'estudi de 300 botigues. Comprovar una botiga.

Què inclou

Com treballem a Labs

Les regles que fan que una peça es pugui citar.

  • Mètode abans que resultat: la mostra, els criteris i la data es publiquen amb la dada, i a l'estudi de l'ecommerce el protocol es va congelar abans de mesurar
  • Zero xifres inventades: si no s'ha mesurat, no es publica; si el client no ho ha validat, no porta el seu nom
  • Repro abans que opinió: un experiment inclou els passos per repetir-lo, i un bug inclou el repro
  • Es corregeix en públic: quan la dada contradiu la tesi, es canvia la tesi i queda escrit
  • Primer a casa: kiwop.com i Nexo són el primer banc de proves de tot el que recomanem
  • Set idiomes: cada peça es publica en els set idiomes de la web, amb la seva URL pròpia

Com treballem

Com proposar un experiment

Si tens una pregunta que mereix una mesura, la fem.

  1. 01

    Ens expliques la pregunta

    Què vols saber i per què importa per al teu negoci: si la teva web està a punt per a agents, si un RAG millora la teva atenció al client, quant del teu trànsit ja ve d'un model de llenguatge.

    Una trucada
  2. 02

    Dissenyem el mètode i el publiquem abans de mesurar

    Mostra, criteris, eines i què comptaria com a resultat. Publicat abans de mesurar perquè ningú pugui ajustar la vara després.

    Una setmana
  3. 03

    Mesurem i publiquem, digui el que digui la dada

    El resultat surt amb el mètode i el dataset. Si contradiu el que esperàvem, el publiquem igualment: és el que fa que la següent peça es pugui creure.

    Segons l'experiment

La prova

Primer a casa, després al client

Tot el que publiquem a Labs ho hem provat abans als nostres propis sistemes: Nexo, la plataforma amb què operem Kiwop, fa córrer 27 agents d'IA en producció amb aprovació humana i traçabilitat; i kiwop.com és la web amb què validem rendiment, accessibilitat, agentic browsing i WebMCP abans de tocar una web aliena. Quan alguna cosa falla, com el crash de Chrome 150, es documenta i es publica el repro.

  • 8 Peces de font primària publicades
  • 5 Eines obertes
  • 0 Xifres sense mètode

Preguntes freqüents

Preguntes sobre Kiwop Labs

El que ens pregunten sobre aquesta secció.

Què és Kiwop Labs?

La secció de kiwop.com on publiquem font primària: experiments reproduïbles, mesures amb mètode i dataset, i enginyeria en obert dels sistemes que operem. No és el blog: aquí només hi entra el que s'ha mesurat o construït, amb els passos per repetir-ho.

Puc reproduir els experiments?

Sí, és la condició per publicar-los. Cada experiment inclou els passos, les eines i les versions. El repro de WebMCP està publicat tal com el vam enviar a Chromium, i el test d'agentic browsing el pots passar a la teva pròpia web.

Publiqueu les dades?

Quan hi ha dades, sí: mostra, criteris de selecció i data van amb el resultat, i el dataset es publica amb l'informe (el de l'estudi de l'ecommerce, amb els 300 dominis i la regla de selecció). El que no publiquem són dades de clients sense la seva validació ni xifres propietàries de tercers.

Per què una agència publica això?

Perquè és la manera més honesta de demostrar que en sabem: la dada original se cita, l'opinió no. Un model de llenguatge que respon a "quina agència sap d'agents d'IA" enllaça qui va publicar la mesura, no qui ho afirma. I a nosaltres ens obliga a provar abans de recomanar.

Puc proposar un experiment?

Sí. Explica'ns la pregunta i per què importa per al teu negoci. Si mereix una mesura, dissenyem el mètode, el publiquem abans de mesurar i publiquem el resultat digui el que digui. Escriu-nos.

Amb quina freqüència publiqueu?

Quan hi ha alguna cosa mesurada, no per calendari. L'objectiu des del setembre de 2026 és una o dues peces al mes, sempre amb mètode i en els set idiomes de la web.

Això substitueix els vostres serveis?

No, els sosté. El que aprenem a Labs és el que apliquem en agents d'IA, RAG empresarial, GEO i auditories d'IA per a clients. Si busques un projecte, comença per aquí.

Següent pas

Tens una pregunta que mereix un experiment?

Explica-nos-la. Si mereix una mesura, publiquem el mètode abans de mesurar i el resultat digui el que digui.

  • Sense compromís
  • Resposta en 24h
  • Proposta personalitzada
Última actualització: setembre del 2026

Parlem.

Consulta tècnica inicial

IA, seguretat i rendiment. Diagnòstic i proposta tancada per fases.

  • NDA disponible
  • Resposta <24h
  • Proposta per fases

La teva primera reunió és amb un Arquitecte de Solucions, no amb un comercial.

Sol·licitar diagnòstic