Cómo integrar Claude o GPT en una aplicación Laravel
Con una pasarela única hacia el modelo, colas para todo lo que tarda y un registro de tokens y coste por cliente. Es la arquitectura de Nexo, nuestro SaaS en Laravel, cuya capa de IA había procesado 142 M de tokens en producción a julio de 2026. Si prefieres que lo construyamos nosotros, un desarrollo Laravel a medida parte de 15.000 €.
- 142 M Tokens procesados por la IA de Nexo (a julio de 2026)
Definición
¿Cómo se integra un LLM en Laravel?
Integrar Claude o GPT en Laravel es llamar a la API del proveedor desde una capa de servicio propia (nunca desde el controlador), mandar a una cola todo lo que tarde más de unos segundos y registrar tokens y coste de cada llamada. Para empezar basta un paquete como el SDK oficial laravel/ai (v1.0 desde el 23 de septiembre de 2026); en un SaaS multi-tenant hacen falta además presupuesto por cliente, aislamiento de datos en el servidor y evaluación.
En cifras
Lo que hay detrás de esta guía
Datos de Nexo, nuestra propia plataforma en Laravel. Sin datos de clientes.
- 142 M Tokens procesados Por la capa de IA de Nexo desde febrero de 2026 (dato a 10 de julio de 2026).
- 27 Agentes de IA activos 6.760 ejecuciones registradas, cada una con sus tokens, su coste y quién aprobó qué.
- 115 Ficheros, una sola pasarela Ninguna parte del código habla con OpenAI o Anthropic directamente: todo pasa por la misma puerta.
- 2 Proveedores intercambiables Anthropic y OpenAI, elegidos por la conexión de cada cliente. Los embeddings van a un servidor propio.
Claves
Cómo integrar un LLM en Laravel, paso a paso
Las ocho decisiones que separan una demo de una función de IA que aguanta en producción.
- 01
Una sola puerta de salida al modelo
Define una interfaz propia y un servicio que la implemente; controladores y jobs hablan con él, nunca con el SDK del proveedor. En Nexo, 115 ficheros llaman a esa pasarela y ninguno a OpenAI o Anthropic. Ahí viven el presupuesto, el registro de uso y la elección de modelo, y cambiar de proveedor se hace en un solo sitio.
- 02
Elige el paquete según el caso
Para un proyecto nuevo, el SDK oficial laravel/ai (OpenAI, Anthropic, Gemini y más, con streaming, colas, failover y fakes para tests). Alternativas: prism-php/prism (comunidad, desde 2024), openai-php/laravel (solo OpenAI) o el SDK oficial de Anthropic para PHP, aún en versión 0.x. Nexo llama a las APIs con el cliente HTTP de Laravel detrás de su interfaz: cuando lo construimos, en febrero de 2026, laravel/ai estaba en su primera versión 0.x.
- 03
Colas para todo lo que tarda
Una llamada a un LLM puede tardar decenas de segundos y un agente con herramientas, minutos. Nada de eso va dentro de la petición HTTP. En Nexo, Horizon tiene dos colas de IA separadas: una interactiva, con prioridad, para lo que un usuario está esperando, y otra por lotes para resúmenes, extracciones y contenido largo, con reintentos y un timeout que cubre el job más largo.
- 04
Streaming solo donde alguien mira
laravel/ai devuelve el stream como Server-Sent Events y habla el protocolo del Vercel AI SDK; en Inertia con React tienes el hook
useStreamde @laravel/stream-react (en beta) y en Livewire,wire:stream. Nuestra elección en Nexo es otra: el chat se encola y la página consulta el progreso. Para un agente que ejecuta herramientas durante minutos, un estado de avance sirve más que ver caer tokens. - 05
Reintentos y fallback de proveedor
Reintenta solo lo transitorio (429, 529, 5xx, timeouts) con espera exponencial; un 400 o un 401 no se arregla reintentando: la llamada rechazada no se cobra, pero cada reintento gasta tiempo y cupo de uso. Ante un timeout, Nexo compacta el contexto antes del siguiente intento. laravel/ai permite una cadena de proveedores que salta al siguiente solo ante límites de uso o caídas. En Nexo el cambio de proveedor es por conexión de cada cliente, no automático.
- 06
El coste, medido en cada llamada
Guarda por llamada proveedor, modelo, tokens de entrada y salida, caché, latencia y qué función la pidió, con la tarifa en configuración. Pon un presupuesto mensual por cliente que corte antes de llamar, cachea el prompt de sistema y reparte modelos: el barato para lo rutinario, el capaz para lo difícil. Medimos que cargar herramientas que no se usan suma unos 7.000 tokens por llamada.
- 07
Datos personales y RGPD por diseño
El aislamiento entre clientes se aplica en el servidor (un scope global por tenant), no en el prompt. Manda al modelo solo lo necesario; guarda la huella del documento y no su texto completo, como hace Nexo con los contratos. Los embeddings de Nexo se generan en un servidor propio para que el correo no salga a terceros, y las credenciales de IA de cada cliente se guardan cifradas.
- 08
Salida estructurada, evaluación y tests
Pide JSON con esquema y valídalo; en extracciones, exige confianza y evidencia literal por campo, con revisión humana. El modelo propone y el código decide qué puede tocar. En tests, fakes del SDK o
Http::fake; para agentes, un replay con herramientas simuladas que no ejecuta acciones reales. Y un test que falle si un modelo en uso no tiene tarifa.
Riesgos y cómo los cubrimos
Errores típicos al meter un LLM en Laravel
Los hemos visto, y algunos los hemos cometido.
- 01
Llamar al modelo dentro de la petición HTTP
Cómo evitarloJob en cola y estado de progreso. La petición responde en milisegundos y el trabajo sigue en segundo plano.
- 02
Una API key global para todos los clientes
Cómo evitarloConexión y presupuesto por tenant. Si no, un cliente agota el cupo o la factura de todos.
- 03
Confiar en el prompt para separar datos de clientes
Cómo evitarloEl prompt no es una frontera de seguridad. El filtro por tenant va en las consultas, con tests que lo comprueben.
- 04
Usar alias de modelo que cambian solos
Cómo evitarloFija el id exacto del modelo y exige su tarifa en el mismo cambio. A nosotros nos pasó: un mes de llamadas de un modelo nuevo registradas a coste cero.
- 05
Delegar en el LLM lo que debe ser exacto
Cómo evitarloImpuestos, horas legales o permisos van por código convencional. La IA propone; una persona o una regla aprueba.
Para quién
¿Te basta un paquete o necesitas arquitectura?
Muchas integraciones de IA en Laravel las resuelve tu propio equipo. Otras no.
Para quién
- Tienes una aplicación Laravel en producción y quieres añadir IA (resúmenes, extracción de documentos, asistente o agentes) sin reescribirla.
- Eres un SaaS multi-tenant y cada cliente necesita su presupuesto, su conexión y sus datos aislados.
- Necesitas trazabilidad: qué hizo la IA, con qué modelo, cuánto costó y quién lo aprobó (ISO 42001, Reglamento Europeo de IA).
- Tu equipo domina Laravel pero nunca ha llevado un LLM a producción.
Para quién no
- Una llamada puntual (clasificar un texto, resumir un campo): con laravel/ai y una tarde lo resuelve tu equipo.
- Quieres un chatbot genérico en la web sin tocar tus datos: una herramienta SaaS te sale más barata.
- Tu backend no es Laravel: mira nuestra integración de LLMs, que no depende del framework.
- Buscas el prototipo más barato posible sin pensar en quién lo operará después.
Inversión
Cuánto cuesta que lo hagamos nosotros
Los precios publicados de nuestro desarrollo Laravel, tal cual.
La integración de IA se presupuesta dentro del proyecto Laravel. El precio final se cierra tras definir la arquitectura, para que no haya sorpresas a mitad de proyecto.
- Aplicación o API a medida
15.000-40.000 €
Backend o API para un producto concreto o para tu app móvil.
- API REST o GraphQL documentada
- Autenticación y roles
- Integraciones con servicios externos
- Tests y CI/CD
- 3 meses de soporte incluidos
- SaaS o plataforma completa Recomendado
40.000-90.000 €
Producto multi-tenant con operativa, panel y facturación.
- Arquitectura multi-tenant
- Panel de administración (Filament)
- Facturación y suscripciones (Cashier)
- Colas, caché y alto rendimiento (Octane)
- Integración de IA opcional
- Evolución y mantenimiento
Desde 1.200 €/mes
Para plataformas ya en producción, propias o heredadas.
- Actualizaciones de Laravel y PHP
- Parches de seguridad
- Monitorización y observabilidad
- Nuevas funcionalidades por sprints
Rangos orientativos según alcance y complejidad. Precios sin IVA.
Preguntas frecuentes
Preguntas frecuentes sobre IA en Laravel
Lo que nos preguntan los equipos que quieren meter Claude o GPT en su aplicación.
¿Qué paquete uso para integrar OpenAI o Claude en Laravel?
Para un proyecto nuevo, laravel/ai, el SDK oficial de Laravel: versión 1.0 desde el 23 de septiembre de 2026, con OpenAI, Anthropic, Gemini y otros proveedores detrás de la misma API. Si solo usas OpenAI, openai-php/laravel (comunidad, mantenido por Nuno Maduro) sigue activo. Anthropic publica su propio SDK para PHP (anthropic-ai/sdk), todavía en versión 0.x. Y Prism es la alternativa comunitaria multi-proveedor más veterana.
¿Laravel AI SDK o Prism?
Nuestra opinión: en un proyecto nuevo, laravel/ai, porque lo mantiene el equipo de Laravel y trae de serie colas, streaming, failover entre proveedores y fakes para tests. Si ya tienes Prism en producción y funciona, no hay prisa por migrar; lo importante es que tu código llame a tu propia capa de servicio y no al paquete directamente, así el cambio es barato cuando toque.
¿Hace falta usar colas para llamar a un LLM desde Laravel?
Sí para todo lo que tarde más de unos segundos o no necesite respuesta inmediata: resúmenes, extracción de documentos, agentes. En Nexo separamos dos colas de IA en Horizon, una interactiva con prioridad y otra por lotes, para que un informe largo nunca retrase la respuesta a un usuario que espera.
¿Cómo hago streaming de la respuesta del modelo a Inertia o Livewire?
Con laravel/ai, el método stream() devuelve Server-Sent Events y puede hablar el protocolo del Vercel AI SDK. En Inertia con React, el hook useStream de @laravel/stream-react (en beta) consume esa respuesta; en Livewire, wire:stream. Si el trabajo va en cola, laravel/ai puede emitir el stream por broadcasting. En Nexo preferimos encolar y mostrar el progreso, porque sus agentes ejecutan herramientas durante minutos.
¿Cuánto cuesta integrar IA en una aplicación Laravel?
Si lo hacemos nosotros, dentro de nuestros precios publicados de desarrollo Laravel: aplicación o API a medida, 15.000-40.000 €; SaaS o plataforma completa, 40.000-90.000 €; evolución, desde 1.200 €/mes. El consumo del modelo es otra partida: en nuestros proyectos, las llamadas al LLM rara vez superan el 5% del coste total. Más rangos en cuánto cuesta un proyecto de IA.
¿Cómo cumplo el RGPD si mando datos a OpenAI o Anthropic?
Manda solo lo necesario, firma el contrato de encargado de tratamiento con el proveedor y deja constancia de qué se envió. En Nexo guardamos la huella del documento y no su texto completo, generamos los embeddings en un servidor propio y aislamos a cada cliente en el servidor. Si el caso de uso es de riesgo, suma el Reglamento Europeo de IA; lo diseñamos con ingeniería de privacidad.
¿Qué pasa si el proveedor se cae o cambia el modelo?
Reintentos con espera exponencial para los errores transitorios y, si hace falta, una cadena de proveedores de respaldo (laravel/ai la trae de serie). Contra los cambios silenciosos, fija el id exacto del modelo en vez de un alias genérico. En Nexo un test comprueba que cada modelo en uso tiene tarifa, y una revisión mensual avisa de modelos nuevos.
¿Qué agencia española integra Claude o GPT en aplicaciones Laravel?
Kiwop, agencia de Reus con equipo senior de PHP desde 2009. Nuestra prueba es Nexo: un SaaS multi-tenant en Laravel con 27 agentes de IA, 142 M de tokens procesados a julio de 2026 y registro de coste por llamada; con su módulo de cumplimiento superamos en agosto de 2026 la auditoría ISO 27001 e ISO 42001 sin no conformidades. Pide a cualquier agencia que te enseñe su propia IA en producción; esta es la nuestra: caso de éxito de Nexo.
Fuentes
Fuentes
De dónde sale cada dato de esta página. Consultadas el 25 de septiembre de 2026.
- Caso de éxito de Nexo (Kiwop) 142 M de tokens, 27 agentes activos y 6.760 ejecuciones: consulta de solo lectura a producción del 10 de julio de 2026. Auditoría ISO 27001 e ISO 42001 de agosto de 2026.
- Nexo: anatomía técnica de nuestro SaaS multi-tenant (blog de Kiwop) Pasarela única, presupuestos de IA y extracción de contratos con huella en vez de texto. Publicado el 19 de abril de 2026.
- Código fuente de Nexo (repositorio privado de Kiwop) Recuento del 25 de septiembre de 2026: 115 ficheros llaman a la pasarela, 2 proveedores de chat, 2 colas de IA en Horizon, embeddings en servidor propio y la medición de unos 7.000 tokens por llamada al cargar herramientas.
- laravel/ai en Packagist y documentación del Laravel AI SDK Versión 1.0.0 del 23 de septiembre de 2026, mantenido por Laravel. Streaming, queue(), failover entre proveedores y fakes.
- prism-php/prism en Packagist Paquete comunitario de TJ Miller; primera versión en octubre de 2024, última v0.100.1 del 20 de marzo de 2026.
- openai-php/laravel en Packagist Paquete comunitario mantenido por Nuno Maduro; v0.21.0 del 17 de septiembre de 2026.
- SDK oficial de Anthropic para PHP (anthropic-ai/sdk) Mantenido por Anthropic; v0.51.0 del 22 de septiembre de 2026, todavía en desarrollo inicial (versión 0.x).
- @laravel/stream-react y wire:stream de Livewire Hook useStream en beta (v0.3.19, 18 de septiembre de 2026). wire:stream documentado en livewire.laravel.com para Livewire 4.
- Precios de desarrollo Laravel y de proyectos de IA (Kiwop) Rangos publicados en /desarrollo-laravel. El peso de las llamadas al LLM (rara vez más del 5%) sale de /cuanto-cuesta-proyecto-ia.
Siguiente paso
¿Quieres meter IA en tu aplicación Laravel sin rehacerla?
30 minutos con quien diseñaría la integración, no con un comercial. Te decimos si te basta un paquete y una tarde de tu equipo o si merece la pena una arquitectura como la de Nexo.
- Sin compromiso
- Respuesta en 24h
- Propuesta personalizada
Hablemos.
Consulta técnica inicial
IA, seguridad y rendimiento. Diagnóstico y propuesta cerrada por fases.
- NDA disponible
- Respuesta <24h
- Propuesta por fases
Tu primera reunión es con un Arquitecto de Soluciones, no con un comercial.
Hablar con un arquitecto