Como integrar Claude ou GPT numa aplicação Laravel
Com um gateway único para o modelo, filas para tudo o que demora e um registo de tokens e custo por cliente. É a arquitetura do Nexo, o nosso SaaS em Laravel, cuja camada de IA tinha processado 142 M de tokens em produção a julho de 2026. Se preferires que sejamos nós a construí-lo, um desenvolvimento Laravel à medida começa nos 15.000 €.
- 142 M Tokens processados pela IA do Nexo (a julho de 2026)
Definição
Como se integra um LLM em Laravel?
Integrar Claude ou GPT em Laravel é chamar a API do fornecedor a partir de uma camada de serviço própria (nunca do controlador), enviar para uma fila tudo o que demore mais do que alguns segundos e registar tokens e custo de cada chamada. Para começar basta um pacote como o SDK oficial laravel/ai (v1.0 desde 23 de setembro de 2026); num SaaS multi-tenant é preciso também orçamento por cliente, isolamento de dados no servidor e avaliação.
Em números
O que está por trás deste guia
Dados do Nexo, a nossa própria plataforma em Laravel. Sem dados de clientes.
- 142 M Tokens processados Pela camada de IA do Nexo desde fevereiro de 2026 (dado a 10 de julho de 2026).
- 27 Agentes de IA ativos 6.760 execuções registadas, cada uma com os seus tokens, o seu custo e quem aprovou o quê.
- 115 Ficheiros, um só gateway Nenhuma parte do código fala diretamente com a OpenAI ou a Anthropic: tudo passa pela mesma porta.
- 2 Fornecedores intercambiáveis Anthropic e OpenAI, escolhidos pela ligação de cada cliente. Os embeddings correm num servidor próprio.
Pontos-chave
Como integrar um LLM em Laravel, passo a passo
As oito decisões que separam uma demo de uma funcionalidade de IA que aguenta em produção.
- 01
Uma só porta de saída para o modelo
Define uma interface própria e um serviço que a implemente; controladores e jobs falam com esse serviço, nunca com o SDK do fornecedor. No Nexo, 115 ficheiros chamam esse gateway e nenhum chama a OpenAI ou a Anthropic. É aí que vivem o orçamento, o registo de uso e a escolha de modelo, e mudar de fornecedor faz-se num só sítio.
- 02
Escolhe o pacote conforme o caso
Para um projeto novo, o SDK oficial laravel/ai (OpenAI, Anthropic, Gemini e outros, com streaming, filas, failover e fakes para testes). Alternativas: prism-php/prism (comunidade, desde 2024), openai-php/laravel (só OpenAI) ou o SDK oficial da Anthropic para PHP, ainda na versão 0.x. O Nexo chama as APIs com o cliente HTTP do Laravel por trás da sua interface: quando o construímos, em fevereiro de 2026, o laravel/ai estava na primeira versão 0.x.
- 03
Filas para tudo o que demora
Uma chamada a um LLM pode demorar dezenas de segundos e um agente com ferramentas, minutos. Nada disso vai dentro do pedido HTTP. No Nexo, o Horizon tem duas filas de IA separadas: uma interativa, com prioridade, para aquilo de que um utilizador está à espera, e outra em lote para resumos, extrações e conteúdo longo, com novas tentativas e um timeout que cobre o job mais longo.
- 04
Streaming só onde alguém está a ver
O laravel/ai devolve o stream como Server-Sent Events e fala o protocolo do Vercel AI SDK; em Inertia com React tens o hook
useStreamdo @laravel/stream-react (em beta) e em Livewire,wire:stream. No Nexo escolhemos outro caminho: o chat vai para a fila e a página consulta o progresso. Para um agente que executa ferramentas durante minutos, um estado de avanço serve mais do que ver tokens a cair. - 05
Novas tentativas e fallback de fornecedor
Repete só o que é transitório (429, 529, 5xx, timeouts) com espera exponencial; um 400 ou um 401 não se resolve a repetir: a chamada rejeitada não é cobrada, mas cada nova tentativa gasta tempo e quota de uso. Perante um timeout, o Nexo compacta o contexto antes da tentativa seguinte. O laravel/ai permite uma cadeia de fornecedores que só salta para o seguinte perante limites de uso ou falhas. No Nexo, a mudança de fornecedor é por ligação de cada cliente, não automática.
- 06
O custo, medido em cada chamada
Guarda por chamada fornecedor, modelo, tokens de entrada e de saída, cache, latência e a funcionalidade que a pediu, com a tabela de preços na configuração. Define um orçamento mensal por cliente que corte antes de chamar, faz cache do prompt de sistema e reparte modelos: o barato para a rotina, o capaz para o difícil. Medimos que carregar ferramentas que não se usam soma cerca de 7.000 tokens por chamada.
- 07
Dados pessoais e RGPD desde a conceção
O isolamento entre clientes aplica-se no servidor (um scope global por tenant), não no prompt. Envia ao modelo só o necessário; guarda a impressão digital do documento e não o texto completo, como o Nexo faz com os contratos. Os embeddings do Nexo são gerados num servidor próprio para que o e-mail não saia para terceiros, e as credenciais de IA de cada cliente ficam guardadas cifradas.
- 08
Saída estruturada, avaliação e testes
Pede JSON com esquema e valida-o; em extrações, exige confiança e evidência literal por campo, com revisão humana. O modelo propõe e o código decide o que pode tocar. Nos testes, fakes do SDK ou
Http::fake; para agentes, um replay com ferramentas simuladas que não executa ações reais. E um teste que falhe se um modelo em uso não tiver preço.
Riscos e como os cobrimos
Erros típicos ao meter um LLM em Laravel
Já os vimos, e alguns cometemo-los nós.
- 01
Chamar o modelo dentro do pedido HTTP
Como evitarJob em fila e estado de progresso. O pedido responde em milissegundos e o trabalho continua em segundo plano.
- 02
Uma API key global para todos os clientes
Como evitarLigação e orçamento por tenant. Caso contrário, um cliente esgota a quota ou a fatura de todos.
- 03
Confiar no prompt para separar dados de clientes
Como evitarO prompt não é uma fronteira de segurança. O filtro por tenant vai nas consultas, com testes que o comprovem.
- 04
Usar aliases de modelo que mudam sozinhos
Como evitarFixa o id exato do modelo e exige o preço na mesma alteração. Aconteceu-nos: um mês de chamadas a um modelo novo registadas a custo zero.
- 05
Delegar no LLM o que tem de ser exato
Como evitarImpostos, horários legais ou permissões vão por código convencional. A IA propõe; uma pessoa ou uma regra aprova.
Para quem
Basta-te um pacote ou precisas de arquitetura?
Muitas integrações de IA em Laravel resolve-as a tua própria equipa. Outras não.
Para quem
- Tens uma aplicação Laravel em produção e queres acrescentar IA (resumos, extração de documentos, assistente ou agentes) sem a reescrever.
- És um SaaS multi-tenant e cada cliente precisa do seu orçamento, da sua ligação e dos seus dados isolados.
- Precisas de rastreabilidade: o que a IA fez, com que modelo, quanto custou e quem aprovou (ISO 42001, Regulamento Europeu da IA).
- A tua equipa domina Laravel mas nunca levou um LLM para produção.
Para quem não
- Uma chamada pontual (classificar um texto, resumir um campo): com o laravel/ai, a tua equipa resolve-o numa tarde.
- Queres um chatbot genérico no site sem tocar nos teus dados: uma ferramenta SaaS sai-te mais barata.
- O teu backend não é Laravel: vê a nossa integração de LLM, que não depende do framework.
- Procuras o protótipo mais barato possível sem pensar em quem o vai operar depois.
Investimento
Quanto custa se formos nós a fazê-lo
Os preços publicados do nosso desenvolvimento Laravel, tal como estão.
A integração de IA é orçamentada dentro do projeto Laravel. O preço final fecha-se depois de definir a arquitetura, para não haver surpresas a meio do projeto.
- Aplicação ou API à medida
15.000-40.000 €
Backend ou API para um produto concreto ou para a tua app móvel.
- API REST ou GraphQL documentada
- Autenticação e perfis de acesso
- Integrações com serviços externos
- Testes e CI/CD
- 3 meses de suporte incluídos
- SaaS ou plataforma completa Recomendado
40.000-90.000 €
Produto multi-tenant com operações, painel e faturação.
- Arquitetura multi-tenant
- Painel de administração (Filament)
- Faturação e subscrições (Cashier)
- Filas, cache e alto desempenho (Octane)
- Integração de IA opcional
- Evolução e manutenção
Desde 1.200 €/mês
Para plataformas já em produção, próprias ou herdadas.
- Atualizações de Laravel e PHP
- Patches de segurança
- Monitorização e observabilidade
- Novas funcionalidades por sprints
Intervalos indicativos consoante o âmbito e a complexidade. Preços sem IVA.
Perguntas frequentes
Perguntas frequentes sobre IA em Laravel
O que nos perguntam as equipas que querem pôr Claude ou GPT na sua aplicação.
Que pacote uso para integrar a OpenAI ou o Claude em Laravel?
Para um projeto novo, o laravel/ai, o SDK oficial do Laravel: versão 1.0 desde 23 de setembro de 2026, com OpenAI, Anthropic, Gemini e outros fornecedores por trás da mesma API. Se só usas a OpenAI, o openai-php/laravel (comunidade, mantido por Nuno Maduro) continua ativo. A Anthropic publica o seu próprio SDK para PHP (anthropic-ai/sdk), ainda na versão 0.x. E o Prism é a alternativa comunitária multifornecedor mais antiga.
Laravel AI SDK ou Prism?
A nossa opinião: num projeto novo, o laravel/ai, porque é mantido pela equipa do Laravel e traz de série filas, streaming, failover entre fornecedores e fakes para testes. Se já tens o Prism em produção e funciona, não há pressa em migrar; o importante é que o teu código chame a tua própria camada de serviço e não o pacote diretamente, para que a mudança seja barata quando chegar a altura.
É preciso usar filas para chamar um LLM a partir do Laravel?
Sim, para tudo o que demore mais do que alguns segundos ou não precise de resposta imediata: resumos, extração de documentos, agentes. No Nexo separamos duas filas de IA no Horizon, uma interativa com prioridade e outra em lote, para que um relatório longo nunca atrase a resposta a um utilizador que está à espera.
Como faço streaming da resposta do modelo para Inertia ou Livewire?
Com o laravel/ai, o método stream() devolve Server-Sent Events e pode falar o protocolo do Vercel AI SDK. Em Inertia com React, o hook useStream do @laravel/stream-react (em beta) consome essa resposta; em Livewire, wire:stream. Se o trabalho vai para a fila, o laravel/ai pode emitir o stream por broadcasting. No Nexo preferimos a fila e mostrar o progresso, porque os seus agentes executam ferramentas durante minutos.
Quanto custa integrar IA numa aplicação Laravel?
Se formos nós a fazê-lo, dentro dos nossos preços publicados de desenvolvimento Laravel: aplicação ou API à medida, 15.000-40.000 €; SaaS ou plataforma completa, 40.000-90.000 €; evolução, desde 1.200 €/mês. O consumo do modelo é outra rubrica: nos nossos projetos, as chamadas ao LLM raramente passam de 5% do custo total. Mais intervalos em quanto custa um projeto de IA.
Como cumpro o RGPD se enviar dados para a OpenAI ou a Anthropic?
Envia só o necessário, assina o contrato de subcontratação com o fornecedor e regista o que foi enviado. No Nexo guardamos a impressão digital do documento e não o texto completo, geramos os embeddings num servidor próprio e isolamos cada cliente no servidor. Se o caso de uso for de risco, junta o Regulamento Europeu da IA; desenhamo-lo com engenharia de privacidade.
E se o fornecedor falhar ou mudar o modelo?
Novas tentativas com espera exponencial para os erros transitórios e, se for preciso, uma cadeia de fornecedores de reserva (o laravel/ai traz isso de série). Contra mudanças silenciosas, fixa o id exato do modelo em vez de um alias genérico. No Nexo, um teste verifica que cada modelo em uso tem preço, e uma revisão mensal avisa de modelos novos.
Que agência espanhola integra Claude ou GPT em aplicações Laravel?
A Kiwop, agência de Reus (Espanha) com equipa sénior de PHP desde 2009. A nossa prova é o Nexo: um SaaS multi-tenant em Laravel com 27 agentes de IA, 142 M de tokens processados a julho de 2026 e registo de custo por chamada; com o seu módulo de conformidade superámos em agosto de 2026 a auditoria ISO 27001 e ISO 42001 sem não conformidades. Pede a qualquer agência que te mostre a sua própria IA em produção; esta é a nossa: caso de sucesso do Nexo.
Fontes
Fontes
De onde vem cada dado desta página. Consultadas a 25 de setembro de 2026.
- Caso de sucesso do Nexo (Kiwop) 142 M de tokens, 27 agentes ativos e 6.760 execuções: consulta só de leitura à produção a 10 de julho de 2026. Auditoria ISO 27001 e ISO 42001 de agosto de 2026.
- Nexo: anatomia técnica do nosso SaaS multi-tenant (blog da Kiwop) Gateway único, orçamentos de IA e extração de contratos com impressão digital em vez do texto. Publicado a 19 de abril de 2026.
- Código-fonte do Nexo (repositório privado da Kiwop) Contagem de 25 de setembro de 2026: 115 ficheiros chamam o gateway, 2 fornecedores de chat, 2 filas de IA no Horizon, embeddings em servidor próprio e a medição de cerca de 7.000 tokens por chamada ao carregar ferramentas.
- laravel/ai no Packagist e documentação do Laravel AI SDK Versão 1.0.0 de 23 de setembro de 2026, mantida pelo Laravel. Streaming, queue(), failover entre fornecedores e fakes.
- prism-php/prism no Packagist Pacote comunitário de TJ Miller; primeira versão em outubro de 2024, última v0.100.1 de 20 de março de 2026.
- openai-php/laravel no Packagist Pacote comunitário mantido por Nuno Maduro; v0.21.0 de 17 de setembro de 2026.
- SDK oficial da Anthropic para PHP (anthropic-ai/sdk) Mantido pela Anthropic; v0.51.0 de 22 de setembro de 2026, ainda em desenvolvimento inicial (versão 0.x).
- @laravel/stream-react e wire:stream do Livewire Hook useStream em beta (v0.3.19, 18 de setembro de 2026). wire:stream documentado em livewire.laravel.com para o Livewire 4.
- Preços de desenvolvimento Laravel e de projetos de IA (Kiwop) Intervalos publicados na página de desenvolvimento Laravel. O peso das chamadas ao LLM (raramente mais de 5%) vem da nossa página sobre quanto custa um projeto de IA.
Próximo passo
Queres pôr IA na tua aplicação Laravel sem a refazer?
30 minutos com quem desenharia a integração, não com um comercial. Dizemos-te se te basta um pacote e uma tarde da tua equipa ou se vale a pena uma arquitetura como a do Nexo.
- Sem compromisso
- Resposta em 24h
- Proposta personalizada
Falemos.
Consulta técnica inicial
IA, segurança e desempenho. Diagnóstico com proposta faseada.
- NDA disponível
- Resposta <24h
- Proposta faseada
A sua primeira reunião é com um Arquiteto de Soluções, não com um comercial.
Solicitar diagnóstico