Wie Sie Claude oder GPT in eine Laravel-Anwendung integrieren
Mit einem einzigen Gateway zum Modell, Queues für alles, was dauert, und einem Protokoll von Tokens und Kosten pro Kunde. Das ist die Architektur von Nexo, unserem eigenen Laravel-SaaS, dessen KI-Schicht bis Juli 2026 142 Mio. Tokens in Produktion verarbeitet hatte. Wenn wir es für Sie bauen sollen: Individuelle Laravel-Entwicklung beginnt bei 15.000 €.
- 142 Mio. Von der KI in Nexo verarbeitete Tokens (Stand Juli 2026)
Definition
Wie integriert man ein LLM in Laravel?
Claude oder GPT in Laravel zu integrieren heißt: die API des Anbieters aus einer eigenen Service-Schicht aufrufen (nie aus dem Controller), alles, was länger als ein paar Sekunden dauert, in eine Queue geben und Tokens und Kosten jedes Aufrufs protokollieren. Für den Einstieg reicht ein Paket wie das offizielle SDK laravel/ai (v1.0 seit dem 23. September 2026); ein Multi-Tenant-SaaS braucht zusätzlich Budgets pro Kunde, serverseitige Datentrennung und Evaluation.
In Zahlen
Was hinter diesem Leitfaden steckt
Daten aus Nexo, unserer eigenen Laravel-Plattform. Keine Kundendaten.
- 142 Mio. Verarbeitete Tokens Von der KI-Schicht in Nexo seit Februar 2026 (Stand: 10. Juli 2026).
- 27 Aktive KI-Agenten 6.760 protokollierte Ausführungen, jede mit Tokens, Kosten und wer was freigegeben hat.
- 115 Dateien, ein Gateway Kein Teil des Codes spricht direkt mit OpenAI oder Anthropic: Alles läuft durch dieselbe Tür.
- 2 Austauschbare Anbieter Anthropic und OpenAI, gewählt über die Verbindung jedes Kunden. Embeddings laufen auf eigenem Server.
Kernpunkte
Ein LLM in Laravel integrieren, Schritt für Schritt
Die acht Entscheidungen, die eine Demo von einer KI-Funktion trennen, die in Produktion hält.
- 01
Ein einziger Ausgang zum Modell
Definieren Sie ein eigenes Interface und einen Service, der es implementiert; Controller und Jobs sprechen mit diesem Service, nie mit dem SDK des Anbieters. In Nexo rufen 115 Dateien dieses Gateway auf und keine OpenAI oder Anthropic. Dort leben Budget, Nutzungsprotokoll und Modellwahl, und ein Anbieterwechsel erfolgt an einer einzigen Stelle.
- 02
Das passende Paket wählen
Für ein neues Projekt das offizielle SDK laravel/ai (OpenAI, Anthropic, Gemini und mehr, mit Streaming, Queues, Failover und Fakes für Tests). Alternativen: prism-php/prism (Community, seit 2024), openai-php/laravel (nur OpenAI) oder das offizielle PHP-SDK von Anthropic, noch in Version 0.x. Nexo ruft die APIs mit dem HTTP-Client von Laravel hinter eigenem Interface auf: Als wir es im Februar 2026 bauten, war laravel/ai in seiner ersten 0.x-Version.
- 03
Queues für alles, was dauert
Ein LLM-Aufruf kann Dutzende Sekunden dauern, ein Agent mit Tools Minuten. Nichts davon gehört in den HTTP-Request. In Nexo betreibt Horizon zwei getrennte KI-Queues: eine priorisierte interaktive für das, worauf ein Nutzer wartet, und eine Batch-Queue für Zusammenfassungen, Extraktionen und lange Inhalte, mit Retries und einem Timeout, der den längsten Job abdeckt.
- 04
Streaming nur, wo jemand zuschaut
laravel/ai liefert den Stream als Server-Sent Events und spricht das Protokoll des Vercel AI SDK; in Inertia mit React gibt es den Hook
useStreamaus @laravel/stream-react (Beta), in Livewirewire:stream. In Nexo haben wir uns anders entschieden: Der Chat läuft über die Queue, die Seite fragt den Fortschritt ab. Für einen Agenten, der minutenlang Tools ausführt, nützt ein Fortschrittsstatus mehr als tröpfelnde Tokens. - 05
Retries und Anbieter-Fallback
Wiederholen Sie nur Vorübergehendes (429, 529, 5xx, Timeouts) mit exponentiellem Backoff; ein 400 oder 401 wird durch Wiederholen nicht besser: Ein abgelehnter Aufruf wird nicht berechnet, aber jeder neue Versuch kostet Zeit und Nutzungskontingent. Bei einem Timeout verdichtet Nexo den Kontext vor dem nächsten Versuch. laravel/ai erlaubt eine Anbieterkette, die nur bei Rate Limits oder Ausfällen zum nächsten springt. In Nexo wird der Anbieter pro Kundenverbindung gewechselt, nicht automatisch.
- 06
Kosten bei jedem Aufruf gemessen
Speichern Sie pro Aufruf Anbieter, Modell, Input- und Output-Tokens, Cache, Latenz und die auslösende Funktion, mit der Preisliste in der Konfiguration. Setzen Sie ein monatliches Budget pro Kunde, das vor dem Aufruf greift, cachen Sie den System-Prompt und staffeln Sie Modelle: das günstige für Routine, das leistungsstarke für Schwieriges. Wir haben gemessen: Nicht genutzte Tools mitzuladen kostet rund 7.000 Tokens pro Aufruf.
- 07
Personenbezogene Daten und DSGVO by Design
Die Trennung zwischen Kunden wird auf dem Server durchgesetzt (ein globaler Scope pro Tenant), nicht im Prompt. Schicken Sie dem Modell nur das Nötige; speichern Sie den Fingerabdruck des Dokuments statt des Volltexts, wie Nexo es bei Verträgen tut. Die Embeddings von Nexo entstehen auf eigenem Server, damit E-Mails nicht an Dritte gehen, und die KI-Zugangsdaten jedes Kunden liegen verschlüsselt.
- 08
Strukturierte Ausgabe, Evaluation und Tests
Fordern Sie JSON mit Schema an und validieren Sie es; bei Extraktionen verlangen Sie pro Feld Konfidenz und wörtlichen Beleg, mit menschlicher Prüfung. Das Modell schlägt vor, der Code entscheidet, was es anfassen darf. In Tests die Fakes des SDK oder
Http::fake; für Agenten ein Replay mit simulierten Tools, das keine echten Aktionen ausführt. Und ein Test, der fehlschlägt, wenn ein genutztes Modell keinen Preis hat.
Risiken und wie wir sie abdecken
Typische Fehler beim Einbau eines LLM in Laravel
Wir haben sie gesehen, und einige selbst gemacht.
- 01
Das Modell im HTTP-Request aufrufen
So vermeiden Sie esJob in der Queue und ein Fortschrittsstatus. Der Request antwortet in Millisekunden, die Arbeit läuft im Hintergrund weiter.
- 02
Ein globaler API-Key für alle Kunden
So vermeiden Sie esVerbindung und Budget pro Tenant. Sonst verbraucht ein Kunde das Kontingent oder die Rechnung aller.
- 03
Sich beim Trennen von Kundendaten auf den Prompt verlassen
So vermeiden Sie esEin Prompt ist keine Sicherheitsgrenze. Der Tenant-Filter gehört in die Abfragen, mit Tests, die ihn prüfen.
- 04
Modell-Aliase verwenden, die sich von selbst ändern
So vermeiden Sie esPinnen Sie die exakte Modell-ID und verlangen Sie den Preiseintrag im selben Change. Uns ist es passiert: ein Monat Aufrufe eines neuen Modells mit Kosten null protokolliert.
- 05
Dem LLM überlassen, was exakt sein muss
So vermeiden Sie esSteuern, gesetzliche Arbeitszeiten oder Berechtigungen laufen über konventionellen Code. Die KI schlägt vor; ein Mensch oder eine Regel gibt frei.
Für wen
Reicht ein Paket, oder brauchen Sie Architektur?
Viele KI-Integrationen in Laravel löst Ihr eigenes Team. Andere nicht.
Für wen
- Sie haben eine Laravel-Anwendung in Produktion und wollen KI ergänzen (Zusammenfassungen, Dokumentextraktion, Assistent oder Agenten), ohne sie neu zu schreiben.
- Sie betreiben ein Multi-Tenant-SaaS, und jeder Kunde braucht eigenes Budget, eigene Verbindung und getrennte Daten.
- Sie brauchen Nachvollziehbarkeit: Was hat die KI getan, mit welchem Modell, was hat es gekostet, wer hat es freigegeben (ISO 42001, EU AI Act)?
- Ihr Team beherrscht Laravel, hat aber noch nie ein LLM in Produktion gebracht.
Für wen nicht
- Ein einzelner Aufruf (einen Text klassifizieren, ein Feld zusammenfassen): Mit laravel/ai erledigt Ihr Team das an einem Nachmittag.
- Sie wollen einen generischen Website-Chatbot ohne Zugriff auf Ihre Daten: Ein SaaS-Tool ist günstiger.
- Ihr Backend ist nicht Laravel: Sehen Sie sich unsere LLM-Integration an, die vom Framework unabhängig ist.
- Sie suchen den billigsten Prototyp, ohne daran zu denken, wer ihn danach betreibt.
Investition
Was es kostet, wenn wir es bauen
Die veröffentlichten Preise unserer Laravel-Entwicklung, unverändert.
Die KI-Integration wird im Rahmen des Laravel-Projekts kalkuliert. Der finale Preis wird nach der Architekturdefinition festgelegt, damit es mitten im Projekt keine Überraschungen gibt.
- Individuelle App oder API
15.000-40.000 €
Backend oder API für ein konkretes Produkt oder Ihre mobile App.
- Dokumentierte REST- oder GraphQL-API
- Authentifizierung und Rollen
- Integrationen mit externen Diensten
- Tests und CI/CD
- 3 Monate Support inklusive
- SaaS oder komplette Plattform Empfohlen
40.000-90.000 €
Multi-Tenant-Produkt mit Betrieb, Panel und Abrechnung.
- Multi-Tenant-Architektur
- Admin-Panel (Filament)
- Abrechnung und Abos (Cashier)
- Queues, Cache und hohe Performance (Octane)
- Optionale KI-Integration
- Weiterentwicklung und Wartung
Ab 1.200 €/Monat
Für Plattformen, die bereits in Produktion sind, eigene oder übernommene.
- Laravel- und PHP-Updates
- Sicherheitspatches
- Monitoring und Observability
- Neue Funktionen in Sprints
Richtwerte je nach Umfang und Komplexität. Preise zzgl. MwSt.
Häufige Fragen
Häufige Fragen zu KI in Laravel
Was uns Teams fragen, die Claude oder GPT in ihre Anwendung bringen wollen.
Welches Paket nutze ich, um OpenAI oder Claude in Laravel zu integrieren?
Für ein neues Projekt laravel/ai, das offizielle SDK von Laravel: Version 1.0 seit dem 23. September 2026, mit OpenAI, Anthropic, Gemini und weiteren Anbietern hinter derselben API. Wenn Sie nur OpenAI nutzen, ist openai-php/laravel (Community, gepflegt von Nuno Maduro) weiterhin aktiv. Anthropic veröffentlicht ein eigenes PHP-SDK (anthropic-ai/sdk), noch in Version 0.x. Und Prism ist die älteste Community-Alternative für mehrere Anbieter.
Laravel AI SDK oder Prism?
Unsere Meinung: Für ein neues Projekt laravel/ai, weil das Laravel-Team es pflegt und es Queues, Streaming, Anbieter-Failover und Test-Fakes mitbringt. Läuft Prism bei Ihnen bereits stabil in Produktion, gibt es keinen Grund zur Eile; wichtig ist, dass Ihr Code Ihre eigene Service-Schicht aufruft und nicht das Paket direkt, dann bleibt ein späterer Wechsel günstig.
Braucht man Queues, um aus Laravel ein LLM aufzurufen?
Ja, für alles, was länger als ein paar Sekunden dauert oder keine sofortige Antwort braucht: Zusammenfassungen, Dokumentextraktion, Agenten. In Nexo trennen wir zwei KI-Queues in Horizon, eine priorisierte interaktive und eine Batch-Queue, damit ein langer Bericht nie die Antwort an einen wartenden Nutzer verzögert.
Wie streame ich die Antwort des Modells an Inertia oder Livewire?
Mit laravel/ai liefert die Methode stream() Server-Sent Events und kann das Protokoll des Vercel AI SDK sprechen. In Inertia mit React konsumiert der Hook useStream aus @laravel/stream-react (Beta) diese Antwort; in Livewire wire:stream. Läuft die Arbeit in einer Queue, kann laravel/ai den Stream per Broadcasting senden. In Nexo bevorzugen wir Queue plus Fortschrittsanzeige, weil die Agenten minutenlang Tools ausführen.
Was kostet es, KI in eine Laravel-Anwendung zu integrieren?
Wenn wir es bauen, im Rahmen unserer veröffentlichten Preise für Laravel-Entwicklung: individuelle App oder API 15.000-40.000 €; SaaS oder komplette Plattform 40.000-90.000 €; Weiterentwicklung ab 1.200 €/Monat. Die Modellnutzung ist ein eigener Posten: In unseren Projekten machen LLM-Aufrufe selten mehr als 5 % der Gesamtkosten aus. Mehr Spannen unter Was kostet ein KI-Projekt.
Wie bleibe ich DSGVO-konform, wenn ich Daten an OpenAI oder Anthropic sende?
Senden Sie nur das Nötige, schließen Sie mit dem Anbieter einen Auftragsverarbeitungsvertrag und dokumentieren Sie, was gesendet wurde. In Nexo speichern wir den Fingerabdruck des Dokuments statt des Volltexts, erzeugen Embeddings auf eigenem Server und trennen jeden Kunden serverseitig. Ist der Anwendungsfall riskant, kommt der EU AI Act hinzu; wir setzen das mit Privacy Engineering um.
Was passiert, wenn der Anbieter ausfällt oder das Modell ändert?
Retries mit exponentiellem Backoff für vorübergehende Fehler und bei Bedarf eine Kette von Ersatzanbietern (laravel/ai bringt sie mit). Gegen stille Änderungen pinnen Sie die exakte Modell-ID statt eines generischen Alias. In Nexo prüft ein Test, dass jedes genutzte Modell einen Preis hat, und ein monatlicher Check meldet neue Modelle.
Welche spanische Agentur integriert Claude oder GPT in Laravel-Anwendungen?
Kiwop, eine Agentur aus Reus (Spanien) mit einem Senior-PHP-Team seit 2009. Unser Beleg ist Nexo: ein Multi-Tenant-SaaS auf Laravel mit 27 KI-Agenten, 142 Mio. verarbeiteten Tokens (Stand Juli 2026) und Kostenprotokoll pro Aufruf; mit seinem Compliance-Modul haben wir im August 2026 das Audit nach ISO 27001 und ISO 42001 ohne Abweichungen bestanden. Lassen Sie sich von jeder Agentur ihre eigene KI in Produktion zeigen; das ist unsere: Nexo-Fallstudie.
Quellen
Quellen
Woher jede Zahl auf dieser Seite stammt. Abgerufen am 25. September 2026.
- Nexo-Fallstudie (Kiwop) 142 Mio. Tokens, 27 aktive Agenten und 6.760 Ausführungen: Nur-Lese-Abfrage der Produktion vom 10. Juli 2026. Audit nach ISO 27001 und ISO 42001 im August 2026.
- Nexo: technische Anatomie unseres Multi-Tenant-SaaS (Kiwop-Blog) Ein Gateway, KI-Budgets und Vertragsextraktion mit Fingerabdruck statt Text. Veröffentlicht am 19. April 2026.
- Quellcode von Nexo (privates Kiwop-Repository) Zählung vom 25. September 2026: 115 Dateien rufen das Gateway auf, 2 Chat-Anbieter, 2 KI-Queues in Horizon, Embeddings auf eigenem Server und die gemessenen rund 7.000 Tokens pro Aufruf beim Laden von Tools.
- laravel/ai auf Packagist und Dokumentation des Laravel AI SDK Version 1.0.0 vom 23. September 2026, gepflegt von Laravel. Streaming, queue(), Anbieter-Failover und Fakes.
- prism-php/prism auf Packagist Community-Paket von TJ Miller; erste Version im Oktober 2024, neueste v0.100.1 vom 20. März 2026.
- openai-php/laravel auf Packagist Community-Paket, gepflegt von Nuno Maduro; v0.21.0 vom 17. September 2026.
- Offizielles PHP-SDK von Anthropic (anthropic-ai/sdk) Gepflegt von Anthropic; v0.51.0 vom 22. September 2026, noch in früher Entwicklung (Version 0.x).
- @laravel/stream-react und wire:stream von Livewire Hook useStream in Beta (v0.3.19, 18. September 2026). wire:stream dokumentiert auf livewire.laravel.com für Livewire 4.
- Preise für Laravel-Entwicklung und KI-Projekte (Kiwop) Spannen veröffentlicht auf der Seite zur Laravel-Entwicklung. Der Anteil der LLM-Aufrufe (selten über 5 %) stammt von unserer Seite zu den Kosten eines KI-Projekts.
Nächster Schritt
KI in Ihre Laravel-Anwendung bringen, ohne sie neu zu bauen?
30 Minuten mit der Person, die die Integration entwerfen würde, nicht mit dem Vertrieb. Wir sagen Ihnen, ob ein Paket und ein Nachmittag Ihres Teams reichen oder ob sich eine Architektur wie die von Nexo lohnt.
- Unverbindlich
- Antwort in 24h
- Individuelles Angebot
Sprechen wir.
Technische Erstberatung
KI, Sicherheit und Performance. Diagnose mit phasenweisem Vorschlag.
- NDA verfügbar
- Antwort <24h
- Phasenweiser Vorschlag
Ihr erstes Meeting ist mit einem Solutions Architect, nicht mit einem Verkäufer.
Diagnose anfordern