KiwopLabs:oquetestamosantesdeorecomendar

Experiências reproduzíveis, medições com método e dataset, e engenharia em aberto dos nossos próprios sistemas. Fonte primária, não opinião: cada peça liga a como foi medida e, quando há dados, ao dataset.

100 × 4 + 3/3 kiwop.com no teste de agentic browsing
Scroll

O que é o Kiwop Labs?

O Kiwop Labs é o sítio onde publicamos o que testamos antes de o recomendar a um cliente: experiências reproduzíveis (com os passos para as repetir), medições com método e dataset (amostra, critérios e data) e peças de engenharia em aberto sobre os sistemas que operamos, a começar pelos nossos.

A razão é simples: em IA há muita opinião e pouca medição. Quando um modelo de linguagem ou uma pessoa procura uma resposta, cita quem traz o dado original e explica como o obteve. Por isso aqui não há números sem método, e se um dado contradiz a nossa tese, muda-se a tese (já aconteceu com o estudo do ecommerce: o piloto derrubou a hipótese de partida e publicámo-lo na mesma).

Labs em números

Só números já publicados neste site, com a sua fonte.

100 × 4 Lighthouse em kiwop.com

Desempenho, acessibilidade, boas práticas e SEO, no teste de agentic browsing

3 / 3 Tarefas agênticas concluídas

Um agente navega, encontra e conclui as três tarefas do teste

300 Lojas medidas

Estudo "Estado da IA no ecommerce espanhol 2026", dupla passagem

7 Idiomas

Cada peça, nos sete idiomas do site

Experiências e repros

Cada uma com os passos para a repetir.

01

Teste de agentic browsing

Verificamos se um agente de IA consegue navegar no teu site e concluir tarefas reais, com as auditorias do Lighthouse e três tarefas agênticas. kiwop.com tira 100 nas quatro categorias e conclui 3 em 3. Testa o teu site.

02

WebMCP e o crash do Chrome 150

Ativámos o WebMCP em produção e o Chrome matava o separador ao primeiro clique. Bissetámos o gatilho (router + tools imperativas + tool declarativa ao mesmo tempo) e publicámos o repro para o Chromium. A experiência e o repro público.

03

MCP 2026-07-28: o protocolo sem estado

Lemos a quinta revisão do MCP no dia em que saiu e explicámos o que muda mesmo (fim das sessões e do handshake, cabeçalhos de encaminhamento), o que migrar com pressa e o que não. Ler a análise.

04

RAG, fine-tuning ou MCP: quando usar cada um

Três técnicas que se confundem todos os dias, com os casos em que usámos cada uma em produção e os critérios para escolher. Ler o guia.

05

Como usamos IA para programar numa agência

Sem fumo: como trabalhamos com o Claude Code no dia a dia, o que revemos à mão, onde falha e o que deixámos de fazer. Ler como trabalhamos.

06

Nexo: arquitetura SaaS multi-tenant em Laravel + Inertia

A plataforma com que gerimos a Kiwop, aberta por dentro: isolamento por workspace, permissões por função, a camada de agentes com aprovação humana e o que aprendemos. A arquitetura e o caso com métricas reais.

Dados e medições

Amostra, critérios e data, sempre publicados com o número.

Estado da IA no ecommerce espanhol 2026

300 lojas selecionadas com regra pública (setor × dimensão), medidas com dupla passagem (HTTP identificado e navegador real) em setembro de 2026: crawlers de IA no robots.txt, llms.txt, schema Product, chatbots e pesquisa. O piloto derrubou a hipótese inicial e mudámos a tese. Dataset e método publicam-se com o relatório.

Publicação: setembro de 2026

Nexo: métricas de uma plataforma com agentes em produção

Agentes ativos, execuções registadas, chamadas a ferramentas e tokens processados, extraídos por consulta só de leitura à base de dados de produção, com a data e o método na própria ficha. Ver as métricas.

27 agentes em produção

La Salve: um chatbot de IA com guardrails, em produção

Como está montado o assistente de um ecommerce real: o que decide o modelo, o que corre por lógica determinista e que limites tem. As métricas de operação publicam-se com período e método quando o cliente as valida. Ver o caso.

Arquitetura e guardrails publicados

kiwop.com como banco de ensaio

O nosso próprio site é o primeiro laboratório: a indexação das páginas de IA que o Google deixou meses sem indexar, recuperada no mesmo dia ao cortar um espelho de domínio, com o censo e o método. Ver o caso.

10 em 10 URLs indexados no mesmo dia

Ferramentas abertas

Grátis, sem registo, em sete idiomas.

01

Teste de agentic browsing

Um agente de IA consegue navegar no teu site e concluir uma tarefa? Lighthouse nas quatro categorias e três tarefas agênticas, com o resultado explicado. Fazer o teste.

02

Autodiagnóstico EU AI Act

Um questionário curto para saber se o teu sistema de IA entra no regulamento europeu, em que categoria de risco e que obrigações se aplicam, com as datas verificadas. Fazer o autodiagnóstico.

03

Quanto custa um projeto de IA?

Intervalos de investimento por tipo de projeto de IA, com o que inclui cada escalão e o que o encarece. Calcular o intervalo.

04

Teste de nível de IA

Um teste curto para saber em que ponto está a tua equipa com a IA e que curso da Kiwop Academy encaixa. Fazer o teste.

Como trabalhamos no Labs

As regras que tornam uma peça citável.

Método antes do resultado: a amostra, os critérios e a data publicam-se com o número, e no estudo do ecommerce o protocolo foi congelado antes de medir
Zero números inventados: se não foi medido, não se publica; se o cliente não o validou, não leva o seu nome
Repro antes da opinião: uma experiência inclui os passos para a repetir, e um bug inclui o repro
Corrige-se em público: quando o dado contradiz a tese, muda-se a tese e fica escrito
Primeiro em casa: kiwop.com e o Nexo são o primeiro banco de ensaio de tudo o que recomendamos
Sete idiomas: cada peça publica-se nos sete idiomas do site, com URL própria

Como propor uma experiência

Se tens uma pergunta que merece uma medição, fazemo-la.

01

Contas-nos a pergunta

O que queres saber e porque importa para o teu negócio: se o teu site está pronto para agentes, se um RAG melhora o teu apoio ao cliente, quanto do teu tráfego já vem de um modelo de linguagem.

02

Desenhamos o método e publicamo-lo antes de medir

Amostra, critérios, ferramentas e o que contaria como resultado. Publicado antes de medir para que ninguém possa ajustar a fasquia depois.

03

Medimos e publicamos, diga o que disser o dado

O resultado sai com o método e o dataset. Se contradiz o que esperávamos, publicamo-lo na mesma: é o que faz com que a peça seguinte seja credível.

Primeiro em casa, depois no cliente

Tudo o que publicamos no Labs testámo-lo antes nos nossos próprios sistemas: o Nexo, a plataforma com que operamos a Kiwop, corre 27 agentes de IA em produção com aprovação humana e rastreabilidade; e kiwop.com é o site com que validamos desempenho, acessibilidade, agentic browsing e WebMCP antes de tocar num site alheio. Quando algo falha, como o crash do Chrome 150, documenta-se e publica-se o repro.

6 Peças de fonte primária publicadas
4 Ferramentas abertas
0 Números sem método

Perguntas sobre o Kiwop Labs

O que nos perguntam sobre esta secção.

O que é o Kiwop Labs?

A secção de kiwop.com onde publicamos fonte primária: experiências reproduzíveis, medições com método e dataset, e engenharia em aberto dos sistemas que operamos. Não é o blog: aqui só entra o que foi medido ou construído, com os passos para o repetir.

Posso reproduzir as experiências?

Sim, é a condição para as publicar. Cada experiência inclui os passos, as ferramentas e as versões. O repro do WebMCP está publicado tal como o enviámos ao Chromium, e o teste de agentic browsing podes fazê-lo ao teu próprio site.

Publicam os dados?

Quando há dados, sim: amostra, critérios de seleção e data acompanham o resultado, e o dataset publica-se com o relatório (o do estudo do ecommerce, com os 300 domínios e a regra de seleção). O que não publicamos são dados de clientes sem a sua validação nem números proprietários de terceiros.

Porque é que uma agência publica isto?

Porque é a forma mais honesta de mostrar que sabemos fazê-lo: o dado original cita-se, a opinião não. Um modelo de linguagem que responde a "que agência percebe de agentes de IA" liga a quem publicou a medição, não a quem o afirma. E obriga-nos a testar antes de recomendar.

Posso propor uma experiência?

Sim. Conta-nos a pergunta e porque importa para o teu negócio. Se merece uma medição, desenhamos o método, publicamo-lo antes de medir e publicamos o resultado diga o que disser. Escreve-nos.

Com que frequência publicam?

Quando há algo medido, não por calendário. O objetivo a partir de setembro de 2026 é uma ou duas peças por mês, sempre com método e nos sete idiomas do site.

Isto substitui os vossos serviços?

Não, sustenta-os. O que aprendemos no Labs é o que aplicamos em agentes de IA, RAG empresarial, GEO e auditorias de IA para clientes. Se procuras um projeto, começa por aí.

Tens uma pergunta que merece uma experiência?

Conta-nos. Se merece uma medição, publicamos o método antes de medir e o resultado diga o que disser.

Propor uma experiência
Sem compromisso Resposta em 24h Proposta personalizada
Última atualização: setembro de 2026

Consulta
técnica inicial.

IA, segurança e desempenho. Diagnóstico com proposta faseada.

NDA disponível
Resposta <24h
Proposta faseada

A sua primeira reunião é com um Arquiteto de Soluções, não com um comercial.

Solicitar diagnóstico