Kiwop Labs: Was wir testen, bevor wir es empfehlen

Reproduzierbare Experimente, Messungen mit Methode und Datensatz und offenes Engineering unserer eigenen Systeme. Primärquelle statt Meinung: Jedes Stück verlinkt, wie gemessen wurde, und wenn es Daten gibt, den Datensatz.

  • 100 × 4 + 3/3 kiwop.com im Agentic-Browsing-Test
Scroll

Definition

Was ist Kiwop Labs?

Kiwop Labs ist der Ort, an dem wir veröffentlichen, was wir testen, bevor wir es einem Kunden empfehlen: reproduzierbare Experimente (mit den Schritten zum Nachstellen), Messungen mit Methode und Datensatz (Stichprobe, Kriterien und Datum) und offenes Engineering der Systeme, die wir betreiben, angefangen bei unseren eigenen.

Der Grund ist einfach: In der KI gibt es viel Meinung und wenig Messung. Wenn ein Sprachmodell oder ein Mensch eine Antwort sucht, zitiert es denjenigen, der die Originaldaten liefert und erklärt, wie sie entstanden sind. Deshalb gibt es hier keine Zahl ohne Methode, und wenn ein Datenpunkt unserer These widerspricht, ändern wir die These (so geschehen bei der E-Commerce-Studie: Der Pilot hat die Ausgangshypothese gekippt, und wir haben es trotzdem veröffentlicht).

In Zahlen

Labs in Zahlen

Nur Zahlen, die bereits auf dieser Website veröffentlicht sind, mit Quelle.

  • 100 × 4 Lighthouse auf kiwop.com Performance, Barrierefreiheit, Best Practices und SEO im Agentic-Browsing-Test
  • 3 / 3 Agentische Aufgaben gelöst Ein Agent navigiert, findet und erledigt die drei Aufgaben des Tests
  • 300 Gemessene Shops Studie „Stand der KI im spanischen E-Commerce 2026“, doppelter Durchlauf
  • 7 Sprachen Jedes Stück in den sieben Sprachen der Website

Kernpunkte

Experimente und Repros

Jedes mit den Schritten zum Nachstellen.

  1. 01

    Agentic-Browsing-Test

    Wir prüfen, ob ein KI-Agent Ihre Website navigieren und echte Aufgaben erledigen kann, mit den Lighthouse-Audits und drei agentischen Aufgaben. kiwop.com erreicht 100 in allen vier Kategorien und löst 3 von 3. Testen Sie Ihre Website.

  2. 02

    WebMCP und der Chrome-150-Absturz

    Wir haben WebMCP in Produktion aktiviert, und Chrome hat den Tab beim ersten Klick beendet. Wir haben den Auslöser bisektiert (Router + imperative Tools + deklaratives Tool gleichzeitig) und das Repro für Chromium veröffentlicht. Das Experiment und das öffentliche Repro.

  3. 03

    MCP 2026-07-28: das zustandslose Protokoll

    Wir haben die fünfte Revision von MCP am Erscheinungstag gelesen und erklärt, was sich wirklich ändert (Sessions und Handshake entfallen, Routing-Header), was dringend migriert werden muss und was nicht. Analyse lesen.

  4. 04

    RAG, Fine-Tuning oder MCP: wann welches

    Drei Techniken, die täglich verwechselt werden, mit den Fällen, in denen wir jede davon in Produktion eingesetzt haben, und den Kriterien für die Wahl. Leitfaden lesen.

  5. 05

    Wie wir KI zum Programmieren in einer Agentur nutzen

    Ohne Hype: wie wir im Alltag mit Claude Code arbeiten, was wir von Hand prüfen, wo es scheitert und was wir nicht mehr tun. Lesen, wie wir arbeiten.

  6. 06

    Nexo: Multi-Tenant-SaaS-Architektur auf Laravel + Inertia

    Die Plattform, mit der wir Kiwop steuern, von innen: Isolation pro Workspace, rollenbasierte Berechtigungen, die Agentenschicht mit menschlicher Freigabe und was wir gelernt haben. Die Architektur und der Case mit echten Kennzahlen.

Anwendungsfälle

Daten und Messungen

Stichprobe, Kriterien und Datum, immer zusammen mit der Zahl veröffentlicht.

  • GEO-Baseline: welche Agenturen LLMs in Spanien nennen

    Jeden Monat stellen wir 40 Kauffragen (15 aus dem Ranking von marketingdirecto, wörtlich übernommen, 15 eigene zu KI-Agenturen und 10 mit dem, was Menschen die Assistenten wirklich fragen) an Assistenten mit Websuche und veröffentlichen, welche Agenturen sie empfehlen, welche Domains sie zitieren und wo Kiwop erscheint, mit den vollständigen Antworten. Zur Serie.

    Monatliche Serie, offener Datensatz

  • Was Spanien die KI fragt, im Vergleich zu Google

    Jeden Monat: wie viele Anfragen KI-Assistenten und Google für 60 Begriffe zu Agenturen, Preisen und KI für Unternehmen erhalten. Preisfragen gehen bereits zuerst an die KI; Lokales bleibt bei Google. Zur Serie.

    Monatlich, offener Datensatz

  • Stand der KI im spanischen E-Commerce 2026

    300 Shops, nach öffentlicher Regel ausgewählt (Branche × Größe), im September 2026 mit doppeltem Durchlauf gemessen (identifiziertes HTTP und echter Browser): KI-Crawler in robots.txt, llms.txt, Product-Schema, Chatbots und Suche. Der Pilot hat die Ausgangshypothese gekippt, und wir haben die These geändert. Datensatz und Methode erscheinen mit dem Bericht. Bericht lesen.

    Veröffentlicht: 300 Shops, offener Datensatz

  • Ranking der KI-Agenturen mit Belegen

    Jeden Monat zählen wir, in wie vielen Antworten von ChatGPT, Claude, Gemini und Perplexity jede spanische KI-, GEO- und Marketingagentur auftaucht, mit den vollständigen Antworten und den zitierten Domains. Kiwop steht dort, wo es steht, und wir sagen es. Zum Ranking.

    Monatlich, automatisch neu berechnet

  • Veröffentlichte Preise digitaler Dienstleistungen in Spanien

    Jedes Quartal kehren wir auf die Preisseiten spanischer Agenturen und Freelancer zurück und prüfen, ob der veröffentlichte Preis noch da ist: Website, Onlineshop, SEO, Wartung, Entwicklungsstunde, KI, Chatbots, GEO und Ads. Nur Preise, die der Anbieter selbst veröffentlicht, mit Wortlaut und URL; Kiwop steht auf der Liste und zählt wie alle anderen. Zum Observatorium.

    Vierteljährlich, offener Datensatz

  • KI-Agenten im Betrieb: die Telemetrie von Nexo, jedes Quartal

    Läufe und Fehler der Agenten, von einem Menschen unterschriebene oder verworfene Vorschläge, vom autonomen Worker gelieferte PRs, klassifizierte E-Mails und Kosten über API und Abonnement. Nur-Lese-Aggregate der Plattform, mit der Kiwop arbeitet, ohne Namen oder Texte. Zur Reihe.

    Vierteljährlich, offene SQL-Abfrage

  • Nexo: Kennzahlen einer Plattform mit Agenten in Produktion

    Aktive Agenten, protokollierte Ausführungen, Tool-Aufrufe und verarbeitete Tokens, per Lesezugriff aus der Produktionsdatenbank gezogen, mit Datum und Methode direkt im Case. Kennzahlen ansehen.

    27 Agenten in Produktion

  • La Salve: ein KI-Chatbot mit Guardrails, in Produktion

    Wie der Assistent eines echten E-Commerce gebaut ist: was das Modell entscheidet, was über deterministische Logik läuft und wo seine Grenzen liegen. Betriebskennzahlen werden mit Zeitraum und Methode veröffentlicht, sobald der Kunde sie freigibt. Case ansehen.

    Architektur und Guardrails veröffentlicht

  • kiwop.com als Prüfstand

    Unsere eigene Website ist das erste Labor: die Indexierung der KI-Seiten, die Google monatelang nicht indexiert hatte, am selben Tag wiederhergestellt, indem wir einen Domain-Spiegel gekappt haben, mit Zensus und Methode. Case ansehen.

    10 von 10 URLs am selben Tag indexiert

Kernpunkte

Offene Tools

Kostenlos, ohne Registrierung, in sieben Sprachen.

  1. 01

    Agentic-Browsing-Test

    Kann ein KI-Agent Ihre Website navigieren und eine Aufgabe erledigen? Lighthouse in allen vier Kategorien und drei agentische Aufgaben, mit erklärtem Ergebnis. Test starten.

  2. 02

    EU-AI-Act-Selbsttest

    Ein kurzer Fragebogen, um herauszufinden, ob Ihr KI-System unter die europäische Verordnung fällt, in welche Risikoklasse und welche Pflichten gelten, mit geprüften Fristen. Selbsttest machen.

  3. 03

    Was kostet ein KI-Projekt?

    Investitionsspannen nach Art des KI-Projekts, mit dem, was jede Stufe enthält und was sie teurer macht. Spanne berechnen.

  4. 04

    KI-Kenntnisse-Test

    Ein kurzer Test, um zu sehen, wo Ihr Team bei KI steht und welcher Kiwop-Academy-Kurs passt. Test machen.

  5. 05

    Ist Ihr Shop bereit für KI?

    Geben Sie die Domain eines Onlineshops ein und erhalten Sie in einer Minute einen öffentlichen Bericht darüber, was ein KI-Assistent sieht: ob er hineinkommt, ob es eine echte llms.txt gibt und ob die Produktseite Preis und Bestand ausgibt. Dieselbe Methode wie die Studie mit 300 Shops. Einen Shop prüfen.

Leistungsumfang

So arbeiten wir in Labs

Die Regeln, die ein Stück zitierfähig machen.

  • Methode vor Ergebnis: Stichprobe, Kriterien und Datum erscheinen mit der Zahl, und bei der E-Commerce-Studie wurde das Protokoll vor der Messung eingefroren
  • Keine erfundenen Zahlen: Was nicht gemessen wurde, wird nicht veröffentlicht; was der Kunde nicht freigegeben hat, trägt nicht seinen Namen
  • Repro vor Meinung: Ein Experiment enthält die Schritte zum Nachstellen, ein Bug enthält das Repro
  • Öffentlich korrigiert: Widersprechen die Daten der These, ändert sich die These, und das bleibt dokumentiert
  • Zuerst bei uns: kiwop.com und Nexo sind der erste Prüfstand für alles, was wir empfehlen
  • Sieben Sprachen: Jedes Stück erscheint in den sieben Sprachen der Website, mit eigener URL

So arbeiten wir

So schlagen Sie ein Experiment vor

Wenn Sie eine Frage haben, die eine Messung verdient, führen wir sie durch.

  1. 01

    Sie nennen uns die Frage

    Was Sie wissen möchten und warum es für Ihr Geschäft zählt: ob Ihre Website bereit für Agenten ist, ob ein RAG Ihren Kundenservice verbessert, wie viel Ihres Traffics schon aus einem Sprachmodell kommt.

    Ein Gespräch
  2. 02

    Wir entwerfen die Methode und veröffentlichen sie vor der Messung

    Stichprobe, Kriterien, Werkzeuge und was als Ergebnis zählt. Vor der Messung veröffentlicht, damit hinterher niemand die Messlatte verschiebt.

    Eine Woche
  3. 03

    Wir messen und veröffentlichen, egal was herauskommt

    Das Ergebnis erscheint mit Methode und Datensatz. Widerspricht es unserer Erwartung, veröffentlichen wir es trotzdem: Das macht das nächste Stück glaubwürdig.

    Je nach Experiment

Der Beweis

Zuerst bei uns, dann beim Kunden

Alles, was wir in Labs veröffentlichen, haben wir zuerst auf unseren eigenen Systemen getestet: Nexo, die Plattform, mit der wir Kiwop betreiben, führt 27 KI-Agenten in Produktion mit menschlicher Freigabe und Nachvollziehbarkeit aus; und kiwop.com ist die Website, auf der wir Performance, Barrierefreiheit, Agentic Browsing und WebMCP validieren, bevor wir eine fremde Website anfassen. Wenn etwas bricht, wie beim Chrome-150-Absturz, wird es dokumentiert und das Repro veröffentlicht.

  • 8 Veröffentlichte Primärquellen-Stücke
  • 5 Offene Tools
  • 0 Zahlen ohne Methode

Häufige Fragen

Fragen zu Kiwop Labs

Was man uns zu diesem Bereich fragt.

Was ist Kiwop Labs?

Der Bereich von kiwop.com, in dem wir Primärquellen veröffentlichen: reproduzierbare Experimente, Messungen mit Methode und Datensatz und offenes Engineering der Systeme, die wir betreiben. Es ist nicht der Blog: Hier landet nur, was gemessen oder gebaut wurde, mit den Schritten zum Nachstellen.

Kann ich die Experimente reproduzieren?

Ja, das ist die Bedingung für die Veröffentlichung. Jedes Experiment enthält die Schritte, die Werkzeuge und die Versionen. Das WebMCP-Repro ist genau so veröffentlicht, wie wir es an Chromium geschickt haben, und den Agentic-Browsing-Test können Sie auf Ihrer eigenen Website ausführen.

Veröffentlicht ihr die Daten?

Wenn es Daten gibt, ja: Stichprobe, Auswahlkriterien und Datum erscheinen mit dem Ergebnis, und der Datensatz mit dem Bericht (bei der E-Commerce-Studie die 300 Domains und die Auswahlregel). Nicht veröffentlichen wir Kundendaten ohne Freigabe und proprietäre Zahlen Dritter.

Warum veröffentlicht eine Agentur so etwas?

Weil es der ehrlichste Beweis dafür ist, dass wir es können: Originaldaten werden zitiert, Meinungen nicht. Ein Sprachmodell, das auf „welche Agentur kennt sich mit KI-Agenten aus“ antwortet, verlinkt denjenigen, der die Messung veröffentlicht hat, nicht denjenigen, der es behauptet. Und es zwingt uns, zu testen, bevor wir empfehlen.

Kann ich ein Experiment vorschlagen?

Ja. Nennen Sie uns die Frage und warum sie für Ihr Geschäft zählt. Verdient sie eine Messung, entwerfen wir die Methode, veröffentlichen sie vor der Messung und veröffentlichen das Ergebnis, egal wie es ausfällt. Schreiben Sie uns.

Wie oft veröffentlicht ihr?

Wenn etwas gemessen ist, nicht nach Kalender. Das Ziel ab September 2026 sind ein bis zwei Stücke pro Monat, immer mit Methode und in den sieben Sprachen der Website.

Ersetzt das eure Dienstleistungen?

Nein, es trägt sie. Was wir in Labs lernen, wenden wir in KI-Agenten, Enterprise RAG, GEO und KI-Audits für Kunden an. Wenn Sie ein Projekt suchen, fangen Sie dort an.

Nächster Schritt

Haben Sie eine Frage, die ein Experiment verdient?

Erzählen Sie sie uns. Verdient sie eine Messung, veröffentlichen wir die Methode vor der Messung und das Ergebnis, egal wie es ausfällt.

  • Unverbindlich
  • Antwort in 24h
  • Individuelles Angebot
Letzte Aktualisierung: September 2026

Sprechen wir.

Technische Erstberatung

KI, Sicherheit und Performance. Diagnose mit phasenweisem Vorschlag.

  • NDA verfügbar
  • Antwort <24h
  • Phasenweiser Vorschlag

Ihr erstes Meeting ist mit einem Solutions Architect, nicht mit einem Verkäufer.

Diagnose anfordern