Kiwop Labs: o que testamos antes de o recomendar

Experiências reproduzíveis, medições com método e dataset, e engenharia em aberto dos nossos próprios sistemas. Fonte primária, não opinião: cada peça liga a como foi medida e, quando há dados, ao dataset.

  • 100 × 4 + 3/3 kiwop.com no teste de agentic browsing
Scroll

Definição

O que é o Kiwop Labs?

O Kiwop Labs é o sítio onde publicamos o que testamos antes de o recomendar a um cliente: experiências reproduzíveis (com os passos para as repetir), medições com método e dataset (amostra, critérios e data) e peças de engenharia em aberto sobre os sistemas que operamos, a começar pelos nossos.

A razão é simples: em IA há muita opinião e pouca medição. Quando um modelo de linguagem ou uma pessoa procura uma resposta, cita quem traz o dado original e explica como o obteve. Por isso aqui não há números sem método, e se um dado contradiz a nossa tese, muda-se a tese (já aconteceu com o estudo do ecommerce: o piloto derrubou a hipótese de partida e publicámo-lo na mesma).

Em números

Labs em números

Só números já publicados neste site, com a sua fonte.

  • 100 × 4 Lighthouse em kiwop.com Desempenho, acessibilidade, boas práticas e SEO, no teste de agentic browsing
  • 3 / 3 Tarefas agênticas concluídas Um agente navega, encontra e conclui as três tarefas do teste
  • 300 Lojas medidas Estudo "Estado da IA no ecommerce espanhol 2026", dupla passagem
  • 7 Idiomas Cada peça, nos sete idiomas do site

Pontos-chave

Experiências e repros

Cada uma com os passos para a repetir.

  1. 01

    Teste de agentic browsing

    Verificamos se um agente de IA consegue navegar no teu site e concluir tarefas reais, com as auditorias do Lighthouse e três tarefas agênticas. kiwop.com tira 100 nas quatro categorias e conclui 3 em 3. Testa o teu site.

  2. 02

    WebMCP e o crash do Chrome 150

    Ativámos o WebMCP em produção e o Chrome matava o separador ao primeiro clique. Bissetámos o gatilho (router + tools imperativas + tool declarativa ao mesmo tempo) e publicámos o repro para o Chromium. A experiência e o repro público.

  3. 03

    MCP 2026-07-28: o protocolo sem estado

    Lemos a quinta revisão do MCP no dia em que saiu e explicámos o que muda mesmo (fim das sessões e do handshake, cabeçalhos de encaminhamento), o que migrar com pressa e o que não. Ler a análise.

  4. 04

    RAG, fine-tuning ou MCP: quando usar cada um

    Três técnicas que se confundem todos os dias, com os casos em que usámos cada uma em produção e os critérios para escolher. Ler o guia.

  5. 05

    Como usamos IA para programar numa agência

    Em detalhe: como trabalhamos com o Claude Code no dia a dia, o que revemos à mão, onde falha e o que deixámos de fazer. Ler como trabalhamos.

  6. 06

    Nexo: arquitetura SaaS multi-tenant em Laravel + Inertia

    A plataforma com que gerimos a Kiwop, aberta por dentro: isolamento por workspace, permissões por função, a camada de agentes com aprovação humana e o que aprendemos. A arquitetura e o caso com métricas reais.

Casos de uso

Dados e medições

Amostra, critérios e data, sempre publicados com o número.

  • Baseline GEO: que agências citam os LLM em Espanha

    Todos os meses lançamos 40 perguntas de compra (15 do ranking da marketingdirecto, reproduzidas tal qual, 15 próprias sobre agências de IA e 10 com o que as pessoas perguntam de verdade aos assistentes) aos assistentes com pesquisa web e publicamos que agências recomendam, que domínios citam e onde aparece a Kiwop, com as respostas íntegras. Ver a série.

    Série mensal, dataset aberto

  • O que se pergunta à IA em Espanha, face ao Google

    Todos os meses, quantas consultas recebem os assistentes de IA e quantas o Google para 60 termos sobre agências, preços e IA para empresas. As perguntas de preço já se fazem primeiro à IA; o local continua no Google. Ver a série.

    Mensal, dataset aberto

  • Estado da IA no ecommerce espanhol 2026

    300 lojas selecionadas com regra pública (setor × dimensão), medidas com dupla passagem (HTTP identificado e navegador real) em setembro de 2026: crawlers de IA no robots.txt, llms.txt, schema Product, chatbots e pesquisa. O piloto derrubou a hipótese inicial e mudámos a tese. Dataset e método publicam-se com o relatório. Ler o relatório.

    Publicado: 300 lojas, dataset aberto

  • Ranking de agências de IA por evidência

    Todos os meses contamos em quantas respostas do ChatGPT, Claude, Gemini e Perplexity aparece cada agência espanhola de IA, GEO e marketing, com as respostas íntegras e os domínios citados. A Kiwop fica onde fica, e dizemo-lo. Ver o ranking.

    Mensal, recalculado automaticamente

  • Preços publicados de serviços digitais em Espanha

    Todos os trimestres voltamos às páginas de tarifas de agências e freelancers de Espanha e verificamos se o preço que publicam continua lá: site, loja online, SEO, manutenção, hora de desenvolvimento, IA, chatbots, GEO e Ads. Só preços publicados pelo próprio fornecedor, com texto literal e URL; a Kiwop está na lista e conta como mais um. Ver o observatório.

    Trimestral, dataset aberto

  • Agentes de IA em produção: a telemetria do Nexo, cada trimestre

    Execuções e falhas dos agentes, propostas assinadas ou descartadas por uma pessoa, PR entregues pelo worker autónomo, correio classificado e custo por API e por subscrição. Agregados só de leitura da plataforma com que a Kiwop opera, sem nomes nem textos. Ver a série.

    Trimestral, consulta SQL aberta

  • Nexo: métricas de uma plataforma com agentes em produção

    Agentes ativos, execuções registadas, chamadas a ferramentas e tokens processados, extraídos por consulta só de leitura à base de dados de produção, com a data e o método na própria ficha. Ver as métricas.

    27 agentes em produção

  • La Salve: um chatbot de IA com guardrails, em produção

    Como está montado o assistente de um ecommerce real: o que decide o modelo, o que corre por lógica determinista e que limites tem. As métricas de operação publicam-se com período e método quando o cliente as valida. Ver o caso.

    Arquitetura e guardrails publicados

  • kiwop.com como banco de ensaio

    O nosso próprio site é o primeiro laboratório: a indexação das páginas de IA que o Google deixou meses sem indexar, recuperada no mesmo dia ao cortar um espelho de domínio, com o censo e o método. Ver o caso.

    10 em 10 URLs indexados no mesmo dia

Pontos-chave

Ferramentas abertas

Grátis, sem registo, em sete idiomas.

  1. 01

    Teste de agentic browsing

    Um agente de IA consegue navegar no teu site e concluir uma tarefa? Lighthouse nas quatro categorias e três tarefas agênticas, com o resultado explicado. Fazer o teste.

  2. 02

    Autodiagnóstico EU AI Act

    Um questionário curto para saber se o teu sistema de IA entra no regulamento europeu, em que categoria de risco e que obrigações se aplicam, com as datas verificadas. Fazer o autodiagnóstico.

  3. 03

    Quanto custa um projeto de IA?

    Intervalos de investimento por tipo de projeto de IA, com o que inclui cada escalão e o que o encarece. Calcular o intervalo.

  4. 04

    Teste de nível de IA

    Um teste curto para saber em que ponto está a tua equipa com a IA e que curso da Kiwop Academy encaixa. Fazer o teste.

  5. 05

    A tua loja está preparada para a IA?

    Escreve o domínio de uma loja online e num minuto tens um relatório público com o que um assistente de IA vê: se consegue entrar, se há llms.txt a sério e se a ficha de produto expõe preço e stock. O mesmo método do estudo de 300 lojas. Verificar uma loja.

O que inclui

Como trabalhamos no Labs

As regras que tornam uma peça citável.

  • Método antes do resultado: a amostra, os critérios e a data publicam-se com o número, e no estudo do ecommerce o protocolo foi congelado antes de medir
  • Zero números inventados: se não foi medido, não se publica; se o cliente não o validou, não leva o seu nome
  • Repro antes da opinião: uma experiência inclui os passos para a repetir, e um bug inclui o repro
  • Corrige-se em público: quando o dado contradiz a tese, muda-se a tese e fica escrito
  • Primeiro em casa: kiwop.com e o Nexo são o primeiro banco de ensaio de tudo o que recomendamos
  • Sete idiomas: cada peça publica-se nos sete idiomas do site, com URL própria

Como trabalhamos

Como propor uma experiência

Se tens uma pergunta que merece uma medição, fazemo-la.

  1. 01

    Contas-nos a pergunta

    O que queres saber e porque importa para o teu negócio: se o teu site está pronto para agentes, se um RAG melhora o teu apoio ao cliente, quanto do teu tráfego já vem de um modelo de linguagem.

    Uma chamada
  2. 02

    Desenhamos o método e publicamo-lo antes de medir

    Amostra, critérios, ferramentas e o que contaria como resultado. Publicado antes de medir para que ninguém possa ajustar a fasquia depois.

    Uma semana
  3. 03

    Medimos e publicamos, diga o que disser o dado

    O resultado sai com o método e o dataset. Se contradiz o que esperávamos, publicamo-lo na mesma: é o que faz com que a peça seguinte seja credível.

    Conforme a experiência

A prova

Primeiro em casa, depois no cliente

Tudo o que publicamos no Labs testámo-lo antes nos nossos próprios sistemas: o Nexo, a plataforma com que operamos a Kiwop, corre 27 agentes de IA em produção com aprovação humana e rastreabilidade; e kiwop.com é o site com que validamos desempenho, acessibilidade, agentic browsing e WebMCP antes de tocar num site alheio. Quando algo falha, como o crash do Chrome 150, documenta-se e publica-se o repro.

  • 8 Peças de fonte primária publicadas
  • 5 Ferramentas abertas
  • 0 Números sem método

Perguntas frequentes

Perguntas sobre o Kiwop Labs

O que nos perguntam sobre esta secção.

O que é o Kiwop Labs?

A secção de kiwop.com onde publicamos fonte primária: experiências reproduzíveis, medições com método e dataset, e engenharia em aberto dos sistemas que operamos. Não é o blog: aqui só entra o que foi medido ou construído, com os passos para o repetir.

Posso reproduzir as experiências?

Sim, é a condição para as publicar. Cada experiência inclui os passos, as ferramentas e as versões. O repro do WebMCP está publicado tal como o enviámos ao Chromium, e o teste de agentic browsing podes fazê-lo ao teu próprio site.

Publicam os dados?

Quando há dados, sim: amostra, critérios de seleção e data acompanham o resultado, e o dataset publica-se com o relatório (o do estudo do ecommerce, com os 300 domínios e a regra de seleção). O que não publicamos são dados de clientes sem a sua validação nem números proprietários de terceiros.

Porque é que uma agência publica isto?

Porque é a forma mais honesta de mostrar que sabemos fazê-lo: o dado original cita-se, a opinião não. Um modelo de linguagem que responde a "que agência percebe de agentes de IA" liga a quem publicou a medição, não a quem o afirma. E obriga-nos a testar antes de recomendar.

Posso propor uma experiência?

Sim. Conta-nos a pergunta e porque importa para o teu negócio. Se merece uma medição, desenhamos o método, publicamo-lo antes de medir e publicamos o resultado diga o que disser. Escreve-nos.

Com que frequência publicam?

Quando há algo medido, não por calendário. O objetivo a partir de setembro de 2026 é uma ou duas peças por mês, sempre com método e nos sete idiomas do site.

Isto substitui os vossos serviços?

Não, sustenta-os. O que aprendemos no Labs é o que aplicamos em agentes de IA, RAG empresarial, GEO e auditorias de IA para clientes. Se procuras um projeto, começa por aí.

Próximo passo

Tens uma pergunta que merece uma experiência?

Conta-nos. Se merece uma medição, publicamos o método antes de medir e o resultado diga o que disser.

  • Sem compromisso
  • Resposta em 24h
  • Proposta personalizada
Última atualização: setembro de 2026

Falemos.

Consulta técnica inicial

IA, segurança e desempenho. Diagnóstico com proposta faseada.

  • NDA disponível
  • Resposta <24h
  • Proposta faseada

A sua primeira reunião é com um Arquiteto de Soluções, não com um comercial.

Solicitar diagnóstico