Kiwop Labs: o que testamos antes de o recomendar
Experiências reproduzíveis, medições com método e dataset, e engenharia em aberto dos nossos próprios sistemas. Fonte primária, não opinião: cada peça liga a como foi medida e, quando há dados, ao dataset.
- 100 × 4 + 3/3 kiwop.com no teste de agentic browsing
Definição
O que é o Kiwop Labs?
O Kiwop Labs é o sítio onde publicamos o que testamos antes de o recomendar a um cliente: experiências reproduzíveis (com os passos para as repetir), medições com método e dataset (amostra, critérios e data) e peças de engenharia em aberto sobre os sistemas que operamos, a começar pelos nossos.
Em números
Labs em números
Só números já publicados neste site, com a sua fonte.
- 100 × 4 Lighthouse em kiwop.com Desempenho, acessibilidade, boas práticas e SEO, no teste de agentic browsing
- 3 / 3 Tarefas agênticas concluídas Um agente navega, encontra e conclui as três tarefas do teste
- 300 Lojas medidas Estudo "Estado da IA no ecommerce espanhol 2026", dupla passagem
- 7 Idiomas Cada peça, nos sete idiomas do site
Pontos-chave
Experiências e repros
Cada uma com os passos para a repetir.
- 01
Teste de agentic browsing
Verificamos se um agente de IA consegue navegar no teu site e concluir tarefas reais, com as auditorias do Lighthouse e três tarefas agênticas. kiwop.com tira 100 nas quatro categorias e conclui 3 em 3. Testa o teu site.
- 02
WebMCP e o crash do Chrome 150
Ativámos o WebMCP em produção e o Chrome matava o separador ao primeiro clique. Bissetámos o gatilho (router + tools imperativas + tool declarativa ao mesmo tempo) e publicámos o repro para o Chromium. A experiência e o repro público.
- 03
MCP 2026-07-28: o protocolo sem estado
Lemos a quinta revisão do MCP no dia em que saiu e explicámos o que muda mesmo (fim das sessões e do handshake, cabeçalhos de encaminhamento), o que migrar com pressa e o que não. Ler a análise.
- 04
RAG, fine-tuning ou MCP: quando usar cada um
Três técnicas que se confundem todos os dias, com os casos em que usámos cada uma em produção e os critérios para escolher. Ler o guia.
- 05
Como usamos IA para programar numa agência
Em detalhe: como trabalhamos com o Claude Code no dia a dia, o que revemos à mão, onde falha e o que deixámos de fazer. Ler como trabalhamos.
- 06
Nexo: arquitetura SaaS multi-tenant em Laravel + Inertia
A plataforma com que gerimos a Kiwop, aberta por dentro: isolamento por workspace, permissões por função, a camada de agentes com aprovação humana e o que aprendemos. A arquitetura e o caso com métricas reais.
Casos de uso
Dados e medições
Amostra, critérios e data, sempre publicados com o número.
-
Baseline GEO: que agências citam os LLM em Espanha
Todos os meses lançamos 40 perguntas de compra (15 do ranking da marketingdirecto, reproduzidas tal qual, 15 próprias sobre agências de IA e 10 com o que as pessoas perguntam de verdade aos assistentes) aos assistentes com pesquisa web e publicamos que agências recomendam, que domínios citam e onde aparece a Kiwop, com as respostas íntegras. Ver a série.
Série mensal, dataset aberto
-
O que se pergunta à IA em Espanha, face ao Google
Todos os meses, quantas consultas recebem os assistentes de IA e quantas o Google para 60 termos sobre agências, preços e IA para empresas. As perguntas de preço já se fazem primeiro à IA; o local continua no Google. Ver a série.
Mensal, dataset aberto
-
Estado da IA no ecommerce espanhol 2026
300 lojas selecionadas com regra pública (setor × dimensão), medidas com dupla passagem (HTTP identificado e navegador real) em setembro de 2026: crawlers de IA no robots.txt, llms.txt, schema Product, chatbots e pesquisa. O piloto derrubou a hipótese inicial e mudámos a tese. Dataset e método publicam-se com o relatório. Ler o relatório.
Publicado: 300 lojas, dataset aberto
-
Ranking de agências de IA por evidência
Todos os meses contamos em quantas respostas do ChatGPT, Claude, Gemini e Perplexity aparece cada agência espanhola de IA, GEO e marketing, com as respostas íntegras e os domínios citados. A Kiwop fica onde fica, e dizemo-lo. Ver o ranking.
Mensal, recalculado automaticamente
-
Preços publicados de serviços digitais em Espanha
Todos os trimestres voltamos às páginas de tarifas de agências e freelancers de Espanha e verificamos se o preço que publicam continua lá: site, loja online, SEO, manutenção, hora de desenvolvimento, IA, chatbots, GEO e Ads. Só preços publicados pelo próprio fornecedor, com texto literal e URL; a Kiwop está na lista e conta como mais um. Ver o observatório.
Trimestral, dataset aberto
-
Agentes de IA em produção: a telemetria do Nexo, cada trimestre
Execuções e falhas dos agentes, propostas assinadas ou descartadas por uma pessoa, PR entregues pelo worker autónomo, correio classificado e custo por API e por subscrição. Agregados só de leitura da plataforma com que a Kiwop opera, sem nomes nem textos. Ver a série.
Trimestral, consulta SQL aberta
-
Nexo: métricas de uma plataforma com agentes em produção
Agentes ativos, execuções registadas, chamadas a ferramentas e tokens processados, extraídos por consulta só de leitura à base de dados de produção, com a data e o método na própria ficha. Ver as métricas.
27 agentes em produção
-
La Salve: um chatbot de IA com guardrails, em produção
Como está montado o assistente de um ecommerce real: o que decide o modelo, o que corre por lógica determinista e que limites tem. As métricas de operação publicam-se com período e método quando o cliente as valida. Ver o caso.
Arquitetura e guardrails publicados
-
kiwop.com como banco de ensaio
O nosso próprio site é o primeiro laboratório: a indexação das páginas de IA que o Google deixou meses sem indexar, recuperada no mesmo dia ao cortar um espelho de domínio, com o censo e o método. Ver o caso.
10 em 10 URLs indexados no mesmo dia
Pontos-chave
Ferramentas abertas
Grátis, sem registo, em sete idiomas.
- 01
Teste de agentic browsing
Um agente de IA consegue navegar no teu site e concluir uma tarefa? Lighthouse nas quatro categorias e três tarefas agênticas, com o resultado explicado. Fazer o teste.
- 02
Autodiagnóstico EU AI Act
Um questionário curto para saber se o teu sistema de IA entra no regulamento europeu, em que categoria de risco e que obrigações se aplicam, com as datas verificadas. Fazer o autodiagnóstico.
- 03
Quanto custa um projeto de IA?
Intervalos de investimento por tipo de projeto de IA, com o que inclui cada escalão e o que o encarece. Calcular o intervalo.
- 04
Teste de nível de IA
Um teste curto para saber em que ponto está a tua equipa com a IA e que curso da Kiwop Academy encaixa. Fazer o teste.
- 05
A tua loja está preparada para a IA?
Escreve o domínio de uma loja online e num minuto tens um relatório público com o que um assistente de IA vê: se consegue entrar, se há llms.txt a sério e se a ficha de produto expõe preço e stock. O mesmo método do estudo de 300 lojas. Verificar uma loja.
O que inclui
Como trabalhamos no Labs
As regras que tornam uma peça citável.
- Método antes do resultado: a amostra, os critérios e a data publicam-se com o número, e no estudo do ecommerce o protocolo foi congelado antes de medir
- Zero números inventados: se não foi medido, não se publica; se o cliente não o validou, não leva o seu nome
- Repro antes da opinião: uma experiência inclui os passos para a repetir, e um bug inclui o repro
- Corrige-se em público: quando o dado contradiz a tese, muda-se a tese e fica escrito
- Primeiro em casa: kiwop.com e o Nexo são o primeiro banco de ensaio de tudo o que recomendamos
- Sete idiomas: cada peça publica-se nos sete idiomas do site, com URL própria
Como trabalhamos
Como propor uma experiência
Se tens uma pergunta que merece uma medição, fazemo-la.
- 01
Contas-nos a pergunta
O que queres saber e porque importa para o teu negócio: se o teu site está pronto para agentes, se um RAG melhora o teu apoio ao cliente, quanto do teu tráfego já vem de um modelo de linguagem.
- 02
Desenhamos o método e publicamo-lo antes de medir
Amostra, critérios, ferramentas e o que contaria como resultado. Publicado antes de medir para que ninguém possa ajustar a fasquia depois.
- 03
Medimos e publicamos, diga o que disser o dado
O resultado sai com o método e o dataset. Se contradiz o que esperávamos, publicamo-lo na mesma: é o que faz com que a peça seguinte seja credível.
A prova
Primeiro em casa, depois no cliente
Tudo o que publicamos no Labs testámo-lo antes nos nossos próprios sistemas: o Nexo, a plataforma com que operamos a Kiwop, corre 27 agentes de IA em produção com aprovação humana e rastreabilidade; e kiwop.com é o site com que validamos desempenho, acessibilidade, agentic browsing e WebMCP antes de tocar num site alheio. Quando algo falha, como o crash do Chrome 150, documenta-se e publica-se o repro.
- 8 Peças de fonte primária publicadas
- 5 Ferramentas abertas
- 0 Números sem método
Perguntas frequentes
Perguntas sobre o Kiwop Labs
O que nos perguntam sobre esta secção.
O que é o Kiwop Labs?
A secção de kiwop.com onde publicamos fonte primária: experiências reproduzíveis, medições com método e dataset, e engenharia em aberto dos sistemas que operamos. Não é o blog: aqui só entra o que foi medido ou construído, com os passos para o repetir.
Posso reproduzir as experiências?
Sim, é a condição para as publicar. Cada experiência inclui os passos, as ferramentas e as versões. O repro do WebMCP está publicado tal como o enviámos ao Chromium, e o teste de agentic browsing podes fazê-lo ao teu próprio site.
Publicam os dados?
Quando há dados, sim: amostra, critérios de seleção e data acompanham o resultado, e o dataset publica-se com o relatório (o do estudo do ecommerce, com os 300 domínios e a regra de seleção). O que não publicamos são dados de clientes sem a sua validação nem números proprietários de terceiros.
Porque é que uma agência publica isto?
Porque é a forma mais honesta de mostrar que sabemos fazê-lo: o dado original cita-se, a opinião não. Um modelo de linguagem que responde a "que agência percebe de agentes de IA" liga a quem publicou a medição, não a quem o afirma. E obriga-nos a testar antes de recomendar.
Posso propor uma experiência?
Sim. Conta-nos a pergunta e porque importa para o teu negócio. Se merece uma medição, desenhamos o método, publicamo-lo antes de medir e publicamos o resultado diga o que disser. Escreve-nos.
Com que frequência publicam?
Quando há algo medido, não por calendário. O objetivo a partir de setembro de 2026 é uma ou duas peças por mês, sempre com método e nos sete idiomas do site.
Isto substitui os vossos serviços?
Não, sustenta-os. O que aprendemos no Labs é o que aplicamos em agentes de IA, RAG empresarial, GEO e auditorias de IA para clientes. Se procuras um projeto, começa por aí.
Próximo passo
Tens uma pergunta que merece uma experiência?
Conta-nos. Se merece uma medição, publicamos o método antes de medir e o resultado diga o que disser.
- Sem compromisso
- Resposta em 24h
- Proposta personalizada
Falemos.
Consulta técnica inicial
IA, segurança e desempenho. Diagnóstico com proposta faseada.
- NDA disponível
- Resposta <24h
- Proposta faseada
A sua primeira reunião é com um Arquiteto de Soluções, não com um comercial.
Solicitar diagnóstico