KiwopLabs:loqueprobamosantesderecomendarlo
Experimentos reproducibles, mediciones con método y dataset, e ingeniería en abierto de nuestros propios sistemas. Fuente primaria, no opinión: cada pieza enlaza cómo se midió y, cuando hay datos, el dataset.
¿Qué es Kiwop Labs?
Kiwop Labs es el sitio donde publicamos lo que probamos antes de recomendarlo a un cliente: experimentos reproducibles (con los pasos para repetirlos), mediciones con método y dataset (con la muestra, los criterios y la fecha) y las piezas de ingeniería en abierto de los sistemas que operamos, empezando por los nuestros.
Labs, en cifras
Solo cifras ya publicadas en la web, con su fuente.
Rendimiento, accesibilidad, buenas prácticas y SEO, en el test de agentic browsing
Un agente navega, encuentra y completa las tres tareas del test
Estudio "Estado de la IA en el ecommerce español 2026", doble pasada
Cada pieza, en los siete idiomas de la web
Experimentos y repros
Cada uno con los pasos para repetirlo.
Test de agentic browsing
Comprobamos si un agente de IA puede navegar tu web y completar tareas reales, con las auditorías de Lighthouse y tres tareas agénticas. kiwop.com saca 100 en las cuatro categorías y completa 3 de 3. Pasa el test a tu web.
WebMCP y el crash de Chrome 150
Activamos WebMCP en producción y Chrome mataba la pestaña al primer clic. Bisecamos el disparador (router + tools imperativas + declarativa a la vez) y publicamos el repro para Chromium. El experimento y el repro público.
MCP 2026-07-28: el protocolo sin estado
Leímos la quinta revisión de MCP el día que salió y explicamos qué cambia de verdad (fuera sesiones y handshake, cabeceras de enrutado) y qué migrar con prisa y qué no. Leer el análisis.
RAG, fine-tuning o MCP: cuándo usar cada uno
Tres técnicas que se confunden a diario, con los casos en los que hemos usado cada una en producción y los criterios para elegir. Leer la guía.
Cómo usamos IA para programar en una agencia
Sin humo: cómo trabajamos con Claude Code en el día a día, qué revisamos a mano, dónde falla y qué hemos dejado de hacer. Leer cómo trabajamos.
Nexo: arquitectura SaaS multi-tenant en Laravel + Inertia
La plataforma con la que gobernamos Kiwop, abierta por dentro: aislamiento por workspace, permisos por rol, la capa de agentes con aprobación humana y lo que aprendimos. La arquitectura y el caso con métricas reales.
Datos y mediciones
Muestra, criterios y fecha, siempre publicados con el dato.
Estado de la IA en el ecommerce español 2026
300 tiendas seleccionadas con regla pública (sector × tamaño), medidas con doble pasada (HTTP identificado y navegador real) en septiembre de 2026: crawlers de IA en robots.txt, llms.txt, schema Product, chatbots y buscadores. El piloto tumbó la hipótesis inicial y cambiamos la tesis. Dataset y método se publican con el informe.
Publicación: septiembre 2026
Nexo: métricas de una plataforma con agentes en producción
Agentes activos, ejecuciones registradas, llamadas a herramientas y tokens procesados, extraídos por consulta de solo lectura de la base de datos de producción, con la fecha y el método en la propia ficha. Ver las métricas.
27 agentes en producción
La Salve: un chatbot de IA con guardrails, en producción
Cómo está montado el asistente de un ecommerce real: qué decide el modelo, qué va por lógica determinista y qué límites tiene. Las métricas de operación se publican con periodo y método cuando el cliente las valida. Ver el caso.
Arquitectura y guardrails publicados
kiwop.com como banco de pruebas
Nuestra propia web es el primer laboratorio: la indexación de las páginas de IA que Google llevaba meses sin indexar, recuperada el mismo día al cortar un espejo de dominio, con el censo y el método. Ver el caso.
10 de 10 URLs indexadas el mismo día
Herramientas abiertas
Gratis, sin registro, en siete idiomas.
Test de agentic browsing
¿Puede un agente de IA navegar tu web y completar una tarea? Lighthouse en las cuatro categorías y tres tareas agénticas, con el resultado explicado. Pasar el test.
Autodiagnóstico EU AI Act
Un cuestionario corto para saber si tu sistema de IA entra en el reglamento europeo, en qué categoría de riesgo y qué obligaciones te aplican, con las fechas verificadas. Hacer el autodiagnóstico.
¿Cuánto cuesta un proyecto de IA?
Rangos de inversión por tipo de proyecto de IA, con lo que incluye cada tramo y lo que lo encarece. Calcular el rango.
Test de nivel de IA
Un test corto para saber en qué punto está tu equipo con la IA y qué curso de Kiwop Academy encaja. Hacer el test.
Cómo trabajamos en Labs
Las reglas que hacen que una pieza se pueda citar.
Cómo proponer un experimento
Si tienes una pregunta que merece una medición, la hacemos.
Nos cuentas la pregunta
Qué quieres saber y por qué importa para tu negocio: si tu web está lista para agentes, si un RAG mejora tu atención al cliente, cuánto de tu tráfico ya viene de un modelo de lenguaje.
Diseñamos el método y lo publicamos antes de medir
Muestra, criterios, herramientas y qué contaría como resultado. Publicado antes de medir para que nadie pueda ajustar la vara después.
Medimos y publicamos, diga lo que diga el dato
El resultado sale con el método y el dataset. Si contradice lo que esperábamos, lo publicamos igual: es lo que hace que la siguiente pieza se pueda creer.
Primero en casa, luego en el cliente
Todo lo que publicamos en Labs lo hemos probado antes en nuestros propios sistemas: Nexo, la plataforma con la que operamos Kiwop, corre 27 agentes de IA en producción con aprobación humana y trazabilidad; y kiwop.com es la web con la que validamos rendimiento, accesibilidad, agentic browsing y WebMCP antes de tocar una web ajena. Cuando algo falla, como el crash de Chrome 150, se documenta y se publica el repro.
Preguntas sobre Kiwop Labs
Lo que nos preguntan sobre esta sección.
¿Qué es Kiwop Labs?
La sección de kiwop.com donde publicamos fuente primaria: experimentos reproducibles, mediciones con método y dataset, e ingeniería en abierto de los sistemas que operamos. No es el blog: aquí solo entra lo que se ha medido o construido, con los pasos para repetirlo.
¿Puedo reproducir los experimentos?
Sí, es la condición para publicarlos. Cada experimento incluye los pasos, las herramientas y las versiones. El repro de WebMCP está publicado tal cual lo mandamos a Chromium, y el test de agentic browsing lo puedes pasar a tu propia web.
¿Publicáis los datos?
Cuando hay datos, sí: muestra, criterios de selección y fecha van con el resultado, y el dataset se publica con el informe (el del estudio del ecommerce, con los 300 dominios y la regla de selección). Lo que no publicamos son datos de clientes sin su validación ni cifras propietarias de terceros.
¿Por qué una agencia publica esto?
Porque es la forma más honesta de demostrar que sabemos hacerlo: el dato original se cita, la opinión no. Un modelo de lenguaje que responde a "qué agencia sabe de agentes de IA" enlaza a quien publicó la medición, no a quien lo afirma. Y a nosotros nos obliga a probar antes de recomendar.
¿Puedo proponer un experimento?
Sí. Cuéntanos la pregunta y por qué importa para tu negocio. Si merece una medición, diseñamos el método, lo publicamos antes de medir y publicamos el resultado diga lo que diga. Escríbenos.
¿Con qué frecuencia publicáis?
Cuando hay algo medido, no por calendario. El objetivo desde septiembre de 2026 es una o dos piezas al mes, siempre con método y en los siete idiomas de la web.
¿Esto sustituye a vuestros servicios?
No, los sostiene. Lo que aprendemos en Labs es lo que aplicamos en agentes de IA, RAG empresarial, GEO y auditorías de IA para clientes. Si buscas un proyecto, empieza por ahí.
¿Tienes una pregunta que merece un experimento?
Cuéntanosla. Si merece una medición, publicamos el método antes de medir y el resultado diga lo que diga.
Proponer un experimento Consulta
técnica inicial.
IA, seguridad y rendimiento. Diagnóstico y propuesta cerrada por fases.
Tu primera reunión es con un Arquitecto de Soluciones, no con un comercial.
Hablar con un arquitecto