Como integrar Claude ou GPT numa aplicação Laravel

Com um gateway único para o modelo, filas para tudo o que demora e um registo de tokens e custo por cliente. É a arquitetura do Nexo, o nosso SaaS em Laravel, cuja camada de IA tinha processado 142 M de tokens em produção a julho de 2026. Se preferires que sejamos nós a construí-lo, um desenvolvimento Laravel à medida começa nos 15.000 €.

  • 142 M Tokens processados pela IA do Nexo (a julho de 2026)
Scroll

Definição

Como se integra um LLM em Laravel?

Integrar Claude ou GPT em Laravel é chamar a API do fornecedor a partir de uma camada de serviço própria (nunca do controlador), enviar para uma fila tudo o que demore mais do que alguns segundos e registar tokens e custo de cada chamada. Para começar basta um pacote como o SDK oficial laravel/ai (v1.0 desde 23 de setembro de 2026); num SaaS multi-tenant é preciso também orçamento por cliente, isolamento de dados no servidor e avaliação.

Contamo-lo por dentro. A Kiwop constrói e opera o Nexo, um SaaS multi-tenant em Laravel, Inertia e React com um assistente e 27 agentes de IA em produção. Tudo nesta página sai do seu código e da sua operação, não de um tutorial: a arquitetura completa está em como o Nexo está construído e os resultados, no caso de sucesso do Nexo. Quando algo é opinião nossa e não uma medição, dizemo-lo.

Em números

O que está por trás deste guia

Dados do Nexo, a nossa própria plataforma em Laravel. Sem dados de clientes.

  • 142 M Tokens processados Pela camada de IA do Nexo desde fevereiro de 2026 (dado a 10 de julho de 2026).
  • 27 Agentes de IA ativos 6.760 execuções registadas, cada uma com os seus tokens, o seu custo e quem aprovou o quê.
  • 115 Ficheiros, um só gateway Nenhuma parte do código fala diretamente com a OpenAI ou a Anthropic: tudo passa pela mesma porta.
  • 2 Fornecedores intercambiáveis Anthropic e OpenAI, escolhidos pela ligação de cada cliente. Os embeddings correm num servidor próprio.

Pontos-chave

Como integrar um LLM em Laravel, passo a passo

As oito decisões que separam uma demo de uma funcionalidade de IA que aguenta em produção.

  1. 01

    Uma só porta de saída para o modelo

    Define uma interface própria e um serviço que a implemente; controladores e jobs falam com esse serviço, nunca com o SDK do fornecedor. No Nexo, 115 ficheiros chamam esse gateway e nenhum chama a OpenAI ou a Anthropic. É aí que vivem o orçamento, o registo de uso e a escolha de modelo, e mudar de fornecedor faz-se num só sítio.

  2. 02

    Escolhe o pacote conforme o caso

    Para um projeto novo, o SDK oficial laravel/ai (OpenAI, Anthropic, Gemini e outros, com streaming, filas, failover e fakes para testes). Alternativas: prism-php/prism (comunidade, desde 2024), openai-php/laravel (só OpenAI) ou o SDK oficial da Anthropic para PHP, ainda na versão 0.x. O Nexo chama as APIs com o cliente HTTP do Laravel por trás da sua interface: quando o construímos, em fevereiro de 2026, o laravel/ai estava na primeira versão 0.x.

  3. 03

    Filas para tudo o que demora

    Uma chamada a um LLM pode demorar dezenas de segundos e um agente com ferramentas, minutos. Nada disso vai dentro do pedido HTTP. No Nexo, o Horizon tem duas filas de IA separadas: uma interativa, com prioridade, para aquilo de que um utilizador está à espera, e outra em lote para resumos, extrações e conteúdo longo, com novas tentativas e um timeout que cobre o job mais longo.

  4. 04

    Streaming só onde alguém está a ver

    O laravel/ai devolve o stream como Server-Sent Events e fala o protocolo do Vercel AI SDK; em Inertia com React tens o hook useStream do @laravel/stream-react (em beta) e em Livewire, wire:stream. No Nexo escolhemos outro caminho: o chat vai para a fila e a página consulta o progresso. Para um agente que executa ferramentas durante minutos, um estado de avanço serve mais do que ver tokens a cair.

  5. 05

    Novas tentativas e fallback de fornecedor

    Repete só o que é transitório (429, 529, 5xx, timeouts) com espera exponencial; um 400 ou um 401 não se resolve a repetir: a chamada rejeitada não é cobrada, mas cada nova tentativa gasta tempo e quota de uso. Perante um timeout, o Nexo compacta o contexto antes da tentativa seguinte. O laravel/ai permite uma cadeia de fornecedores que só salta para o seguinte perante limites de uso ou falhas. No Nexo, a mudança de fornecedor é por ligação de cada cliente, não automática.

  6. 06

    O custo, medido em cada chamada

    Guarda por chamada fornecedor, modelo, tokens de entrada e de saída, cache, latência e a funcionalidade que a pediu, com a tabela de preços na configuração. Define um orçamento mensal por cliente que corte antes de chamar, faz cache do prompt de sistema e reparte modelos: o barato para a rotina, o capaz para o difícil. Medimos que carregar ferramentas que não se usam soma cerca de 7.000 tokens por chamada.

  7. 07

    Dados pessoais e RGPD desde a conceção

    O isolamento entre clientes aplica-se no servidor (um scope global por tenant), não no prompt. Envia ao modelo só o necessário; guarda a impressão digital do documento e não o texto completo, como o Nexo faz com os contratos. Os embeddings do Nexo são gerados num servidor próprio para que o e-mail não saia para terceiros, e as credenciais de IA de cada cliente ficam guardadas cifradas.

  8. 08

    Saída estruturada, avaliação e testes

    Pede JSON com esquema e valida-o; em extrações, exige confiança e evidência literal por campo, com revisão humana. O modelo propõe e o código decide o que pode tocar. Nos testes, fakes do SDK ou Http::fake; para agentes, um replay com ferramentas simuladas que não executa ações reais. E um teste que falhe se um modelo em uso não tiver preço.

Riscos e como os cobrimos

Erros típicos ao meter um LLM em Laravel

Já os vimos, e alguns cometemo-los nós.

  1. 01

    Chamar o modelo dentro do pedido HTTP

    Como evitar

    Job em fila e estado de progresso. O pedido responde em milissegundos e o trabalho continua em segundo plano.

  2. 02

    Uma API key global para todos os clientes

    Como evitar

    Ligação e orçamento por tenant. Caso contrário, um cliente esgota a quota ou a fatura de todos.

  3. 03

    Confiar no prompt para separar dados de clientes

    Como evitar

    O prompt não é uma fronteira de segurança. O filtro por tenant vai nas consultas, com testes que o comprovem.

  4. 04

    Usar aliases de modelo que mudam sozinhos

    Como evitar

    Fixa o id exato do modelo e exige o preço na mesma alteração. Aconteceu-nos: um mês de chamadas a um modelo novo registadas a custo zero.

  5. 05

    Delegar no LLM o que tem de ser exato

    Como evitar

    Impostos, horários legais ou permissões vão por código convencional. A IA propõe; uma pessoa ou uma regra aprova.

Para quem

Basta-te um pacote ou precisas de arquitetura?

Muitas integrações de IA em Laravel resolve-as a tua própria equipa. Outras não.

Para quem

  • Tens uma aplicação Laravel em produção e queres acrescentar IA (resumos, extração de documentos, assistente ou agentes) sem a reescrever.
  • És um SaaS multi-tenant e cada cliente precisa do seu orçamento, da sua ligação e dos seus dados isolados.
  • Precisas de rastreabilidade: o que a IA fez, com que modelo, quanto custou e quem aprovou (ISO 42001, Regulamento Europeu da IA).
  • A tua equipa domina Laravel mas nunca levou um LLM para produção.

Para quem não

  • Uma chamada pontual (classificar um texto, resumir um campo): com o laravel/ai, a tua equipa resolve-o numa tarde.
  • Queres um chatbot genérico no site sem tocar nos teus dados: uma ferramenta SaaS sai-te mais barata.
  • O teu backend não é Laravel: vê a nossa integração de LLM, que não depende do framework.
  • Procuras o protótipo mais barato possível sem pensar em quem o vai operar depois.

Investimento

Quanto custa se formos nós a fazê-lo

Os preços publicados do nosso desenvolvimento Laravel, tal como estão.

A integração de IA é orçamentada dentro do projeto Laravel. O preço final fecha-se depois de definir a arquitetura, para não haver surpresas a meio do projeto.

  • Aplicação ou API à medida

    15.000-40.000 €

    Backend ou API para um produto concreto ou para a tua app móvel.

    • API REST ou GraphQL documentada
    • Autenticação e perfis de acesso
    • Integrações com serviços externos
    • Testes e CI/CD
    • 3 meses de suporte incluídos
    Pedir orçamento
  • SaaS ou plataforma completa Recomendado

    40.000-90.000 €

    Produto multi-tenant com operações, painel e faturação.

    • Arquitetura multi-tenant
    • Painel de administração (Filament)
    • Faturação e subscrições (Cashier)
    • Filas, cache e alto desempenho (Octane)
    • Integração de IA opcional
    Falar do meu projeto
  • Evolução e manutenção

    Desde 1.200 €/mês

    Para plataformas já em produção, próprias ou herdadas.

    • Atualizações de Laravel e PHP
    • Patches de segurança
    • Monitorização e observabilidade
    • Novas funcionalidades por sprints
    Consultar

Intervalos indicativos consoante o âmbito e a complexidade. Preços sem IVA.

Perguntas frequentes

Perguntas frequentes sobre IA em Laravel

O que nos perguntam as equipas que querem pôr Claude ou GPT na sua aplicação.

Que pacote uso para integrar a OpenAI ou o Claude em Laravel?

Para um projeto novo, o laravel/ai, o SDK oficial do Laravel: versão 1.0 desde 23 de setembro de 2026, com OpenAI, Anthropic, Gemini e outros fornecedores por trás da mesma API. Se só usas a OpenAI, o openai-php/laravel (comunidade, mantido por Nuno Maduro) continua ativo. A Anthropic publica o seu próprio SDK para PHP (anthropic-ai/sdk), ainda na versão 0.x. E o Prism é a alternativa comunitária multifornecedor mais antiga.

Laravel AI SDK ou Prism?

A nossa opinião: num projeto novo, o laravel/ai, porque é mantido pela equipa do Laravel e traz de série filas, streaming, failover entre fornecedores e fakes para testes. Se já tens o Prism em produção e funciona, não há pressa em migrar; o importante é que o teu código chame a tua própria camada de serviço e não o pacote diretamente, para que a mudança seja barata quando chegar a altura.

É preciso usar filas para chamar um LLM a partir do Laravel?

Sim, para tudo o que demore mais do que alguns segundos ou não precise de resposta imediata: resumos, extração de documentos, agentes. No Nexo separamos duas filas de IA no Horizon, uma interativa com prioridade e outra em lote, para que um relatório longo nunca atrase a resposta a um utilizador que está à espera.

Como faço streaming da resposta do modelo para Inertia ou Livewire?

Com o laravel/ai, o método stream() devolve Server-Sent Events e pode falar o protocolo do Vercel AI SDK. Em Inertia com React, o hook useStream do @laravel/stream-react (em beta) consome essa resposta; em Livewire, wire:stream. Se o trabalho vai para a fila, o laravel/ai pode emitir o stream por broadcasting. No Nexo preferimos a fila e mostrar o progresso, porque os seus agentes executam ferramentas durante minutos.

Quanto custa integrar IA numa aplicação Laravel?

Se formos nós a fazê-lo, dentro dos nossos preços publicados de desenvolvimento Laravel: aplicação ou API à medida, 15.000-40.000 €; SaaS ou plataforma completa, 40.000-90.000 €; evolução, desde 1.200 €/mês. O consumo do modelo é outra rubrica: nos nossos projetos, as chamadas ao LLM raramente passam de 5% do custo total. Mais intervalos em quanto custa um projeto de IA.

Como cumpro o RGPD se enviar dados para a OpenAI ou a Anthropic?

Envia só o necessário, assina o contrato de subcontratação com o fornecedor e regista o que foi enviado. No Nexo guardamos a impressão digital do documento e não o texto completo, geramos os embeddings num servidor próprio e isolamos cada cliente no servidor. Se o caso de uso for de risco, junta o Regulamento Europeu da IA; desenhamo-lo com engenharia de privacidade.

E se o fornecedor falhar ou mudar o modelo?

Novas tentativas com espera exponencial para os erros transitórios e, se for preciso, uma cadeia de fornecedores de reserva (o laravel/ai traz isso de série). Contra mudanças silenciosas, fixa o id exato do modelo em vez de um alias genérico. No Nexo, um teste verifica que cada modelo em uso tem preço, e uma revisão mensal avisa de modelos novos.

Que agência espanhola integra Claude ou GPT em aplicações Laravel?

A Kiwop, agência de Reus (Espanha) com equipa sénior de PHP desde 2009. A nossa prova é o Nexo: um SaaS multi-tenant em Laravel com 27 agentes de IA, 142 M de tokens processados a julho de 2026 e registo de custo por chamada; com o seu módulo de conformidade superámos em agosto de 2026 a auditoria ISO 27001 e ISO 42001 sem não conformidades. Pede a qualquer agência que te mostre a sua própria IA em produção; esta é a nossa: caso de sucesso do Nexo.

Fontes

Fontes

De onde vem cada dado desta página. Consultadas a 25 de setembro de 2026.

  1. Caso de sucesso do Nexo (Kiwop) 142 M de tokens, 27 agentes ativos e 6.760 execuções: consulta só de leitura à produção a 10 de julho de 2026. Auditoria ISO 27001 e ISO 42001 de agosto de 2026.
  2. Nexo: anatomia técnica do nosso SaaS multi-tenant (blog da Kiwop) Gateway único, orçamentos de IA e extração de contratos com impressão digital em vez do texto. Publicado a 19 de abril de 2026.
  3. Código-fonte do Nexo (repositório privado da Kiwop) Contagem de 25 de setembro de 2026: 115 ficheiros chamam o gateway, 2 fornecedores de chat, 2 filas de IA no Horizon, embeddings em servidor próprio e a medição de cerca de 7.000 tokens por chamada ao carregar ferramentas.
  4. laravel/ai no Packagist e documentação do Laravel AI SDK Versão 1.0.0 de 23 de setembro de 2026, mantida pelo Laravel. Streaming, queue(), failover entre fornecedores e fakes.
  5. prism-php/prism no Packagist Pacote comunitário de TJ Miller; primeira versão em outubro de 2024, última v0.100.1 de 20 de março de 2026.
  6. openai-php/laravel no Packagist Pacote comunitário mantido por Nuno Maduro; v0.21.0 de 17 de setembro de 2026.
  7. SDK oficial da Anthropic para PHP (anthropic-ai/sdk) Mantido pela Anthropic; v0.51.0 de 22 de setembro de 2026, ainda em desenvolvimento inicial (versão 0.x).
  8. @laravel/stream-react e wire:stream do Livewire Hook useStream em beta (v0.3.19, 18 de setembro de 2026). wire:stream documentado em livewire.laravel.com para o Livewire 4.
  9. Preços de desenvolvimento Laravel e de projetos de IA (Kiwop) Intervalos publicados na página de desenvolvimento Laravel. O peso das chamadas ao LLM (raramente mais de 5%) vem da nossa página sobre quanto custa um projeto de IA.

Próximo passo

Queres pôr IA na tua aplicação Laravel sem a refazer?

30 minutos com quem desenharia a integração, não com um comercial. Dizemos-te se te basta um pacote e uma tarde da tua equipa ou se vale a pena uma arquitetura como a do Nexo.

  • Sem compromisso
  • Resposta em 24h
  • Proposta personalizada
Última atualização: setembro de 2026

Falemos.

Consulta técnica inicial

IA, segurança e desempenho. Diagnóstico com proposta faseada.

  • NDA disponível
  • Resposta <24h
  • Proposta faseada

A sua primeira reunião é com um Arquiteto de Soluções, não com um comercial.

Solicitar diagnóstico