Comment intégrer Claude ou GPT dans une application Laravel

Avec une passerelle unique vers le modèle, des files d'attente pour tout ce qui prend du temps et un journal des tokens et du coût par client. C'est l'architecture de Nexo, notre propre SaaS Laravel, dont la couche IA avait traité 142 M de tokens en production en juillet 2026. Si vous préférez que nous le construisions, un développement Laravel sur mesure démarre à 15 000 €.

  • 142 M Tokens traités par l'IA de Nexo (chiffre de juillet 2026)
Scroll

Définition

Comment intègre-t-on un LLM dans Laravel ?

Intégrer Claude ou GPT dans Laravel, c'est appeler l'API du fournisseur depuis votre propre couche de services (jamais depuis le contrôleur), envoyer dans une file d'attente tout ce qui dure plus de quelques secondes et journaliser les tokens et le coût de chaque appel. Pour démarrer, un paquet comme le SDK officiel laravel/ai (v1.0 depuis le 23 septembre 2026) suffit ; un SaaS multi-tenant exige en plus un budget par client, une isolation des données côté serveur et de l'évaluation.

Nous l'écrivons de l'intérieur. Kiwop construit et exploite Nexo, un SaaS multi-tenant sur Laravel, Inertia et React, avec un assistant et 27 agents IA en production. Tout ce qui figure sur cette page vient de son code et de son exploitation, pas d'un tutoriel : l'architecture complète est dans comment Nexo est construit et les résultats dans l'étude de cas Nexo. Quand il s'agit de notre avis et non d'une mesure, nous le disons.

En chiffres

Ce qu'il y a derrière ce guide

Des données de Nexo, notre propre plateforme Laravel. Aucune donnée client.

  • 142 M Tokens traités Par la couche IA de Nexo depuis février 2026 (donnée au 10 juillet 2026).
  • 27 Agents IA actifs 6 760 exécutions journalisées, chacune avec ses tokens, son coût et qui a validé quoi.
  • 115 Fichiers, une seule passerelle Aucune partie du code ne parle directement à OpenAI ou Anthropic : tout passe par la même porte.
  • 2 Fournisseurs interchangeables Anthropic et OpenAI, choisis via la connexion de chaque client. Les embeddings tournent sur notre propre serveur.

Points clés

Intégrer un LLM dans Laravel, étape par étape

Les huit décisions qui séparent une démo d'une fonctionnalité IA qui tient en production.

  1. 01

    Une seule porte de sortie vers le modèle

    Définissez votre propre interface et un service qui l'implémente ; contrôleurs et jobs parlent à ce service, jamais au SDK du fournisseur. Dans Nexo, 115 fichiers appellent cette passerelle et aucun n'appelle OpenAI ou Anthropic. C'est là que vivent le budget, le journal d'usage et le choix du modèle, et changer de fournisseur se fait à un seul endroit.

  2. 02

    Choisir le paquet selon le cas

    Pour un nouveau projet, le SDK officiel laravel/ai (OpenAI, Anthropic, Gemini et d'autres, avec streaming, files, failover et fakes pour les tests). Alternatives : prism-php/prism (communautaire, depuis 2024), openai-php/laravel (OpenAI uniquement) ou le SDK PHP officiel d'Anthropic, encore en version 0.x. Nexo appelle les API avec le client HTTP de Laravel derrière sa propre interface : quand nous l'avons construit, en février 2026, laravel/ai en était à sa première version 0.x.

  3. 03

    Des files pour tout ce qui prend du temps

    Un appel à un LLM peut durer des dizaines de secondes, un agent avec des outils, des minutes. Rien de cela n'a sa place dans la requête HTTP. Dans Nexo, Horizon gère deux files IA séparées : une file interactive prioritaire pour ce qu'un utilisateur attend, et une file batch pour les résumés, extractions et contenus longs, avec des retries et un timeout qui couvre le job le plus long.

  4. 04

    Du streaming seulement là où quelqu'un regarde

    laravel/ai renvoie le flux en Server-Sent Events et parle le protocole du Vercel AI SDK ; avec Inertia et React, vous avez le hook useStream de @laravel/stream-react (en bêta), et avec Livewire, wire:stream. Dans Nexo, nous avons fait un autre choix : le chat passe par une file et la page interroge la progression. Pour un agent qui exécute des outils pendant des minutes, un état d'avancement est plus utile que des tokens qui défilent.

  5. 05

    Retries et bascule de fournisseur

    Ne relancez que les erreurs transitoires (429, 529, 5xx, timeouts), avec un backoff exponentiel ; un 400 ou un 401 ne se règle pas en relançant : l'appel refusé n'est pas facturé, mais chaque nouvelle tentative consomme du temps et du quota d'usage. Sur un timeout, Nexo compacte le contexte avant la tentative suivante. laravel/ai accepte une chaîne de fournisseurs qui ne bascule qu'en cas de limite de débit ou de panne. Dans Nexo, le fournisseur change par connexion client, pas automatiquement.

  6. 06

    Le coût mesuré à chaque appel

    Enregistrez par appel le fournisseur, le modèle, les tokens d'entrée et de sortie, le cache, la latence et la fonctionnalité appelante, avec la grille tarifaire en configuration. Fixez un budget mensuel par client qui coupe avant l'appel, mettez le prompt système en cache et répartissez les modèles : le moins cher pour la routine, le plus capable pour le difficile. Nous avons mesuré que charger des outils inutilisés ajoute environ 7 000 tokens par appel.

  7. 07

    Données personnelles et RGPD dès la conception

    L'isolation entre clients s'applique côté serveur (un scope global par tenant), pas dans le prompt. N'envoyez au modèle que le nécessaire ; conservez l'empreinte du document plutôt que son texte intégral, comme Nexo le fait pour les contrats. Les embeddings de Nexo sont générés sur notre propre serveur pour que les e-mails ne partent pas chez un tiers, et les identifiants IA de chaque client sont stockés chiffrés.

  8. 08

    Sortie structurée, évaluation et tests

    Demandez du JSON avec un schéma et validez-le ; pour les extractions, exigez un niveau de confiance et une preuve littérale par champ, avec relecture humaine. Le modèle propose, le code décide de ce qu'il peut toucher. En test, les fakes du SDK ou Http::fake ; pour les agents, un replay avec des outils simulés qui n'exécute aucune action réelle. Et un test qui échoue si un modèle utilisé n'a pas de tarif.

Risques et comment nous les couvrons

Les erreurs typiques quand on ajoute un LLM à Laravel

Nous les avons vues, et en avons commis quelques-unes.

  1. 01

    Appeler le modèle dans la requête HTTP

    Comment l'éviter

    Un job en file et un état de progression. La requête répond en millisecondes et le travail continue en arrière-plan.

  2. 02

    Une clé API globale pour tous les clients

    Comment l'éviter

    Une connexion et un budget par tenant. Sinon, un client épuise le quota ou la facture de tous.

  3. 03

    Compter sur le prompt pour séparer les données des clients

    Comment l'éviter

    Un prompt n'est pas une frontière de sécurité. Le filtre par tenant va dans les requêtes, avec des tests qui le vérifient.

  4. 04

    Utiliser des alias de modèle qui changent tout seuls

    Comment l'éviter

    Figez l'identifiant exact du modèle et exigez son tarif dans la même modification. Cela nous est arrivé : un mois d'appels à un nouveau modèle journalisés à coût zéro.

  5. 05

    Confier au LLM ce qui doit être exact

    Comment l'éviter

    Taxes, horaires légaux ou droits d'accès passent par du code classique. L'IA propose ; une personne ou une règle valide.

Pour qui

Un paquet suffit-il, ou faut-il une architecture ?

Beaucoup d'intégrations IA dans Laravel sont à la portée de votre équipe. D'autres non.

Pour qui

  • Vous avez une application Laravel en production et voulez y ajouter de l'IA (résumés, extraction de documents, assistant ou agents) sans la réécrire.
  • Vous êtes un SaaS multi-tenant et chaque client a besoin de son budget, de sa connexion et de données isolées.
  • Vous avez besoin de traçabilité : ce qu'a fait l'IA, avec quel modèle, pour quel coût et qui l'a validé (ISO 42001, règlement européen sur l'IA).
  • Votre équipe maîtrise Laravel mais n'a jamais mis un LLM en production.

À qui cela ne s'adresse pas

  • Un appel ponctuel (classer un texte, résumer un champ) : avec laravel/ai, votre équipe le règle en un après-midi.
  • Vous voulez un chatbot générique sur votre site, sans toucher à vos données : un outil SaaS vous coûtera moins cher.
  • Votre backend n'est pas en Laravel : voyez notre offre d'intégration de LLM, indépendante du framework.
  • Vous cherchez le prototype le moins cher possible sans penser à qui l'exploitera ensuite.

Investissement

Combien ça coûte si nous le construisons

Les prix publiés de notre développement Laravel, tels quels.

L'intégration de l'IA est chiffrée dans le projet Laravel. Le prix final est fixé après la définition de l'architecture, pour éviter les surprises en cours de projet.

  • Application ou API sur mesure

    15 000-40 000 €

    Backend ou API pour un produit précis ou pour votre app mobile.

    • API REST ou GraphQL documentée
    • Authentification et rôles
    • Intégrations avec des services externes
    • Tests et CI/CD
    • 3 mois de support inclus
    Demander un devis
  • SaaS ou plateforme complète Recommandé

    40 000-90 000 €

    Produit multi-tenant avec exploitation, panneau d'admin et facturation.

    • Architecture multi-tenant
    • Panneau d'administration (Filament)
    • Facturation et abonnements (Cashier)
    • Files d'attente, cache et haute performance (Octane)
    • Intégration d'IA en option
    Parler de mon projet
  • Évolution et maintenance

    À partir de 1 200 €/mois

    Pour des plateformes déjà en production, développées par nous ou héritées.

    • Mises à jour de Laravel et PHP
    • Correctifs de sécurité
    • Monitoring et observabilité
    • Nouvelles fonctionnalités par sprints
    Nous consulter

Fourchettes indicatives selon le périmètre et la complexité. Prix hors TVA.

Questions fréquentes

Questions fréquentes sur l'IA dans Laravel

Ce que nous demandent les équipes qui veulent mettre Claude ou GPT dans leur application.

Quel paquet utiliser pour intégrer OpenAI ou Claude dans Laravel ?

Pour un nouveau projet, laravel/ai, le SDK officiel de Laravel : version 1.0 depuis le 23 septembre 2026, avec OpenAI, Anthropic, Gemini et d'autres fournisseurs derrière la même API. Si vous n'utilisez qu'OpenAI, openai-php/laravel (communautaire, maintenu par Nuno Maduro) reste actif. Anthropic publie son propre SDK PHP (anthropic-ai/sdk), encore en version 0.x. Et Prism est l'alternative communautaire multi-fournisseurs la plus ancienne.

Laravel AI SDK ou Prism ?

Notre avis : pour un nouveau projet, laravel/ai, car l'équipe Laravel le maintient et il intègre files, streaming, bascule entre fournisseurs et fakes de test. Si Prism tourne déjà en production chez vous, rien ne presse ; l'essentiel est que votre code appelle votre propre couche de services et non le paquet directement, pour qu'un changement reste bon marché le moment venu.

Faut-il des files d'attente pour appeler un LLM depuis Laravel ?

Oui pour tout ce qui dure plus de quelques secondes ou ne demande pas de réponse immédiate : résumés, extraction de documents, agents. Dans Nexo, nous séparons deux files IA dans Horizon, une interactive prioritaire et une batch, pour qu'un long rapport ne retarde jamais la réponse à un utilisateur qui attend.

Comment streamer la réponse du modèle vers Inertia ou Livewire ?

Avec laravel/ai, la méthode stream() renvoie des Server-Sent Events et peut parler le protocole du Vercel AI SDK. Avec Inertia et React, le hook useStream de @laravel/stream-react (en bêta) consomme cette réponse ; avec Livewire, wire:stream. Si le travail passe par une file, laravel/ai peut diffuser le flux par broadcasting. Dans Nexo, nous préférons la file et l'affichage de la progression, car ses agents exécutent des outils pendant des minutes.

Combien coûte l'intégration de l'IA dans une application Laravel ?

Si nous la réalisons, dans le cadre de nos prix publiés de développement Laravel : application ou API sur mesure, 15 000-40 000 € ; SaaS ou plateforme complète, 40 000-90 000 € ; évolution, à partir de 1 200 €/mois. La consommation du modèle est un poste à part : dans nos projets, les appels au LLM dépassent rarement 5 % du coût total. D'autres fourchettes dans combien coûte un projet IA.

Comment respecter le RGPD en envoyant des données à OpenAI ou Anthropic ?

N'envoyez que le nécessaire, signez un contrat de sous-traitance avec le fournisseur et gardez une trace de ce qui a été envoyé. Dans Nexo, nous conservons l'empreinte du document plutôt que son texte intégral, générons les embeddings sur notre propre serveur et isolons chaque client côté serveur. Si le cas d'usage est à risque, ajoutez le règlement européen sur l'IA ; nous le concevons avec l'ingénierie de la confidentialité.

Que se passe-t-il si le fournisseur tombe ou change de modèle ?

Des retries avec backoff exponentiel pour les erreurs transitoires et, si besoin, une chaîne de fournisseurs de secours (laravel/ai l'intègre). Contre les changements silencieux, figez l'identifiant exact du modèle plutôt qu'un alias générique. Dans Nexo, un test vérifie que chaque modèle utilisé a un tarif, et un contrôle mensuel signale les nouveaux modèles.

Quelle agence espagnole intègre Claude ou GPT dans des applications Laravel ?

Kiwop, une agence basée à Reus (Espagne) avec une équipe PHP senior depuis 2009. Notre preuve, c'est Nexo : un SaaS multi-tenant sur Laravel avec 27 agents IA, 142 M de tokens traités (chiffre de juillet 2026) et un coût journalisé par appel ; avec son module de conformité, nous avons passé en août 2026 l'audit ISO 27001 et ISO 42001 sans aucune non-conformité. Demandez à toute agence de vous montrer sa propre IA en production ; voici la nôtre : étude de cas Nexo.

Sources

Sources

D'où vient chaque chiffre de cette page. Consultées le 25 septembre 2026.

  1. Étude de cas Nexo (Kiwop) 142 M de tokens, 27 agents actifs et 6 760 exécutions : requête en lecture seule sur la production du 10 juillet 2026. Audit ISO 27001 et ISO 42001 d'août 2026.
  2. Nexo : anatomie technique de notre SaaS multi-tenant (blog Kiwop) Passerelle unique, budgets IA et extraction de contrats avec empreinte au lieu du texte. Publié le 19 avril 2026.
  3. Code source de Nexo (dépôt privé de Kiwop) Comptage du 25 septembre 2026 : 115 fichiers appellent la passerelle, 2 fournisseurs de chat, 2 files IA dans Horizon, embeddings sur serveur propre et la mesure d'environ 7 000 tokens par appel quand les outils sont chargés.
  4. laravel/ai sur Packagist et documentation du Laravel AI SDK Version 1.0.0 du 23 septembre 2026, maintenue par Laravel. Streaming, queue(), bascule entre fournisseurs et fakes.
  5. prism-php/prism sur Packagist Paquet communautaire de TJ Miller ; première version en octobre 2024, dernière v0.100.1 du 20 mars 2026.
  6. openai-php/laravel sur Packagist Paquet communautaire maintenu par Nuno Maduro ; v0.21.0 du 17 septembre 2026.
  7. SDK PHP officiel d'Anthropic (anthropic-ai/sdk) Maintenu par Anthropic ; v0.51.0 du 22 septembre 2026, encore en développement initial (version 0.x).
  8. @laravel/stream-react et wire:stream de Livewire Hook useStream en bêta (v0.3.19, 18 septembre 2026). wire:stream documenté sur livewire.laravel.com pour Livewire 4.
  9. Prix du développement Laravel et des projets IA (Kiwop) Fourchettes publiées sur la page développement Laravel. La part des appels au LLM (rarement plus de 5 %) vient de notre page sur le coût d'un projet IA.

Prochaine étape

Mettre de l'IA dans votre application Laravel sans la refaire ?

30 minutes avec la personne qui concevrait l'intégration, pas avec un commercial. Nous vous disons si un paquet et un après-midi de votre équipe suffisent, ou si une architecture comme celle de Nexo en vaut la peine.

  • Sans engagement
  • Réponse en 24h
  • Proposition personnalisée
Dernière mise à jour : septembre 2026

Parlons-en.

Consultation technique initiale

IA, sécurité et performance. Diagnostic avec proposition par phases.

  • NDA disponible
  • Réponse <24h
  • Proposition par phases

Votre premier rendez-vous est avec un Architecte Solutions, pas un commercial.

Demander un diagnostic