Playwright MCP: der Server für das Model Context Protocol, den Microsoft für Playwright veröffentlicht hat (offizielles Repository). Damit steuert ein KI-Agent einen Browser, indem er den Accessibility Tree der Seiten liest, ohne Screenshots und ohne Vision-Modell. Er kann eine URL öffnen, klicken, ein Formular ausfüllen und lesen, was angezeigt wird.
Immer mehr QA-Teams vertrauen ihre Regressionstests einem Agenten wie Claude an, der an Playwright MCP angebunden ist. Zum Erkunden einer Anwendung oder zum Nachstellen eines Bugs ist das Werkzeug hervorragend. Für einen Test, der bei jedem Release wiederholt wird, fehlt ihm jedoch eine Eigenschaft: genau denselben Ablauf erneut auszuführen. Der Agent entscheidet nämlich bei jedem Durchlauf jede Aktion neu. Delta-QA MCP verteilt die Rollen anders. Ihr Agent erstellt das Szenario in Alltagssprache, anschließend spielt Delta-QA es identisch ab, ohne LLM, und vergleicht jedes Release mit der Referenz.
Das Wesentliche auf einer Seite (Definition, Automatisierung ohne Code, Kriterienraster für die Tool-Auswahl): Automatisierte Regressionstests ohne Code.
Ihr KI-Agent kann bereits auf Ihrer Website navigieren. Verbinden Sie ihn mit Delta-QA: Er schreibt das Szenario, Delta-QA spielt es bei jedem Release erneut ab und fotografiert jeden Schritt. Delta-QA kostenlos testen →
Warum Playwright MCP QA-Teams so überzeugt
Playwright MCP verwandelt eine Anfrage in Alltagssprache in echte Aktionen in einem Browser. Ein Tester schreibt „Prüfe, dass das Kontaktformular eine ungültige E-Mail-Adresse ablehnt“, und der Agent öffnet die Seite, gibt die Daten ein, sendet das Formular ab und berichtet das Ergebnis. Man muss weder ein Skript schreiben noch einen Selektor suchen: Das erklärt die rasche Verbreitung.
Die Zahlen bestätigen das. Das Paket @playwright/mcp ist von 2,2 Millionen npm-Downloads im September 2025 (npm) auf 29,3 Millionen im September 2026 (npm) gestiegen. Sein GitHub-Repository nähert sich der Marke von 38.000 Sternen. Die Downloads schließen auch automatische Installationen ein; die Kennzahl ist daher nicht perfekt. Der Trend ist dagegen eindeutig: 13-mal so viele Downloads in einem Jahr.
Seine Stärken sind real. Seine Werkzeuge wirken auf den Accessibility Tree der Seite. Microsoft beschreibt das als deterministische Anwendung der Werkzeuge, ohne die Mehrdeutigkeiten von Ansätzen auf Basis von Screenshots. Microsoft empfiehlt es für explorative Automatisierung und für Aufgaben, bei denen der Agent den Kontext des Browsers behalten muss. Einen gemeldeten Bug nachstellen, eine Seite nach einem Fix prüfen, eine Funktion entdecken: Bei solchen punktuellen Aufgaben spart es erheblich Zeit.
Playwright MCP ist also ein ausgezeichnetes Werkzeug zur Erkundung. Offen bleibt, ob es Ihr Sicherheitsnetz bei jedem Release werden kann. Wie das Protokoll selbst funktioniert, beschreibt der Artikel Playwright und MCP (Model Context Protocol).
Ein Test, den ein Agent wiederholt, ist kein Regressionstest
Ein Regressionstest hat nur dann Wert, wenn er bei jedem Release denselben Ablauf mit denselben Prüfungen wiederholt. Nur so lässt sich ein Unterschied dem Release zuordnen und nicht dem Test. Ein von einem LLM gesteuerter Agent entscheidet bei jedem Durchlauf jede Aktion neu: Derselbe Prompt kann einen anderen Weg und damit ein anderes Urteil hervorbringen.
Das ist kein Fehler von Playwright, sondern liegt in der Natur von LLMs. Im September 2025 hat das Labor Thinking Machines dieselbe Anfrage 1.000-mal an das Modell Qwen3-235B gestellt, mit einer Temperatur von null, der Einstellung, die eigentlich am stabilsten sein soll. Dabei entstanden 80 verschiedene Antworten (Thinking Machines Lab). Die Werkzeuge von Playwright MCP arbeiten deterministisch. Nicht deterministisch ist die Entscheidung, welches Werkzeug in welcher Reihenfolge aufgerufen wird und auf welches Element es wirkt.
Für ein QA-Team hat das drei konkrete Folgen:
- Ein Fehlschlag verrät nicht, was sich geändert hat. Wenn die Wiederholung scheitert, ist nicht erkennbar, ob die Website eine Regression aufweist oder ob der Agent einen anderen Weg genommen hat.
- Ein Erfolg beweist nicht denselben Ablauf. Der Agent kann die Zielseite über einen Umweg erreichen und daraus schließen, dass alles funktioniert.
- Jeder Durchlauf kostet Zeit und Tokens. Der Agent überlegt bei jedem Schritt von Neuem. Microsoft weist zudem darauf hin, dass MCP umfangreiche Werkzeugschemata und Accessibility Trees in den Kontext des Modells lädt (README von Playwright MCP).
Playwright hat eine eigene Antwort darauf: den Ablauf in Code festschreiben. Seine Test-Agenten erkunden die Anwendung, verfassen einen Plan und verwandeln ihn in Dateien für Playwright Test, die ein dritter Agent repariert, wenn sie kaputtgehen. Für ein Entwicklungsteam, das seinen Testcode versioniert und pflegt, ist das der richtige Weg. Für ein QA-Team, das nicht programmiert, heißt das, TypeScript-Dateien, Selektoren und Assertions zu erben, die gepflegt werden müssen.
Delta-QA MCP: Der Agent erstellt das Szenario, Delta-QA spielt es erneut ab
Der MCP-Server von Delta-QA überlässt dem Agenten, was dieser am besten kann: eine Anfrage in Alltagssprache verstehen. Was der Agent schlecht kann, nimmt der Server ihm ab: einen Ablauf identisch wiederholen. Ihr Agent erstellt das Szenario und schreibt dessen Schritte. Delta-QA spielt sie in seinem eigenen Browser auf Ihrer echten Website erneut ab, fotografiert jeden Schritt und validiert nur, was tatsächlich funktioniert hat.
Der Server stellt acht Werkzeuge bereit, die der Agent selbst entdeckt. Sechs davon genügen, um einen Test zu erstellen, in dieser Reihenfolge:
list_workspaces: Der Agent wählt den Arbeitsbereich, in dem der Test erstellt wird.create_scenario: Er erstellt das Szenario aus einem Namen und einer Start-URL; Schritt 1, das Öffnen der Seite, legt Delta-QA selbst fest.set_scenario_steps: Er schreibt die Schritte des Ablaufs, aus vierzehn Aktionen (Klick, Eingabe, Auswahl, Tastendruck, Scrollen, Navigation…); jeder Schritt zielt auf ein Element der Seite.capture_scenario: Delta-QA spielt das Szenario in seinem Browser auf der echten Website erneut ab und nimmt pro Schritt ein Foto auf.get_capture_result: Der Agent liest das Urteil. Ein Fehlschlag nennt den zu korrigierenden Schritt; der Agent korrigiert ihn und startet die Wiedergabe erneut.activate_scenario: Nach einer erfolgreichen Wiedergabe validiert der Agent das Szenario, und die Aufnahme wird zur Referenz.
Nichts wird auf bloße Behauptung hin validiert. Ein Agent kann den falschen Selektor wählen oder behaupten, ein Ablauf funktioniere: Solange Delta-QA nicht alle Schritte erfolgreich erneut abgespielt hat, bleibt das Szenario ein Entwurf. Die Einzelheiten zu Werkzeugen, Rollen und Schlüsseln stehen auf der Seite MCP-Server von Delta-QA.
| Playwright MCP | Delta-QA MCP | |
|---|---|---|
| Wer den Ablauf ausführt | Der Agent, Aktion für Aktion, bei jedem Durchlauf | Delta-QA, anhand der Schritte, die der Agent einmal geschrieben hat |
| Rolle des LLM bei der Wiedergabe | Es entscheidet über jede Aktion | Keine: Das LLM greift nur bei der Erstellung ein |
| Was nach der Sitzung bleibt | Der Gesprächsverlauf oder Testdateien, die gepflegt werden müssen | Ein Szenario in Delta-QA, lesbar und ohne Code bearbeitbar |
| Beleg für das Ergebnis | Der Bericht des Agenten und seine Screenshots | Ein Foto pro Schritt und ein Urteil, das den fehlgeschlagenen Schritt nennt |
| Nächstes Release | Neuer Durchlauf des Agenten oder Code, der angepasst werden muss | Identische Wiedergabe, verglichen mit der Referenz |
| Stärke | Erkundung, Reproduktion von Bugs, punktuelle Prüfungen | Regressionstests, die bei jedem Release wiederholt werden, ohne Code |
Lassen Sie Ihre Szenarien von Ihrem Agenten schreiben und behalten Sie eine identische Wiedergabe. Delta-QA spielt jeden Schritt auf Ihrer echten Website erneut ab und validiert nur, was tatsächlich funktioniert hat. Delta-QA kostenlos testen →
Beispiel: den Test für den Anmeldeablauf mit Claude Code erstellen
Um Claude Code mit Delta-QA zu verbinden, brauchen Sie einen API-Schlüssel und einen einzigen Befehl. Danach beschreiben Sie den Ablauf so, wie Sie ihn einem Kollegen schildern würden. Der Agent schreibt das Szenario, Delta-QA spielt es erneut ab und bewahrt den Beweis dafür auf, Schritt für Schritt.
- Erstellen Sie Ihr kostenloses Konto und Ihren Arbeitsbereich in Delta-QA.
- Erstellen Sie einen API-Schlüssel unter Einstellungen, Tab Arbeitsbereich, Abschnitt API-Schlüssel. Vergeben Sie einen Namen, die Rolle „Kann bearbeiten“ für einen Agenten, der Szenarien schreibt, und ein Ablaufdatum von 30 Tagen, 90 Tagen oder einem Jahr. Der Schlüssel wird nur einmal angezeigt, zusammen mit dem fertigen Befehl.
- Fügen Sie den Befehl in ein Terminal ein und ersetzen Sie
dqa_…durch Ihren Schlüssel:
claude mcp add --transport http delta-qa https://api.delta-qa.com/api/mcp --header "Authorization: Bearer dqa_…"
- Beschreiben Sie den Ablauf in Claude Code, in Alltagssprache. Zum Beispiel: „Erstelle einen Regressionstest für den Anmeldeablauf auf
https://staging.example.com: Gib die E-Mail-Adresse des Testkontos und das Passwort ein, sende das Formular ab und prüfe dann, ob das Dashboard angezeigt wird.“ - Lassen Sie den Agenten arbeiten. Er erstellt das Szenario, schreibt die Schritte und bittet Delta-QA, sie erneut abzuspielen. Schlägt ein Schritt fehl, zum Beispiel weil ein Button in Schritt 4 nicht gefunden wird, nennt das Urteil ihn: Der Agent korrigiert und startet erneut.
- Validieren Sie. Sobald die Wiedergabe gelingt, aktiviert der Agent das Szenario: Seine Aufnahme wird zur Referenz.
Das Passwort, als sensibler Wert markiert, wird sofort bei Eingang verschlüsselt, bei der Wiedergabe eingegeben und auf den Fotos unkenntlich gemacht. Selbst der Agent kann es nicht mehr lesen. Der API-Schlüssel wirkt nur in seinem Arbeitsbereich, mit den Rechten seiner Rolle, und lässt sich in derselben Ansicht sofort widerrufen.
Danach übernimmt das QA-Team in Delta-QA wieder das Ruder
Nach der Validierung wird das vom Agenten erstellte Szenario zu einem Delta-QA-Szenario wie jedes andere. Es erscheint in Ihrem Arbeitsbereich, lesbar und ohne Code bearbeitbar, als wäre es durch Navigieren aufgezeichnet worden. Die Rolle des Agenten endet damit: Erneut abspielen, vergleichen und entscheiden liegen wieder beim QA-Team, mit allen Werkzeugen von Delta-QA.
Bei jedem Release:
- Mit einem Klick wiedergeben: Das Szenario läuft von allein auf Chrome, Firefox und WebKit, in den Bildschirmbreiten Ihrer Wahl.
- Vergleichen: Der Bericht zeigt Referenz und aktuelle Version Seite an Seite, mit hervorgehobenen und klassifizierten Unterschieden (kritisch, Warnung, gering). Die deterministische KI von Delta-QA ist kein LLM: Dieselbe Abweichung erhält immer dasselbe Urteil.
- Entscheiden: Sie bestätigen die Änderung als neue Referenz oder öffnen den Bug direkt aus dem Bericht.
Der Bericht enthält, was ein Entwickler zur Korrektur braucht: den betroffenen Schritt, die Referenzaufnahme, die aktuelle Aufnahme und die Bereiche, die sich unterscheiden. Diese Angaben lassen sich unverändert an den Entwickler oder an dessen Coding-Agenten weitergeben. Beide gehen dann von einer präzisen Abweichung aus statt von einer ungenauen Beschreibung. Nach der Korrektur bestätigt eine erneute Wiedergabe desselben Szenarios, dass die Regression verschwunden ist.
Ihr Agent schreibt das Szenario, Delta-QA bewahrt den Beweis. Erstellen Sie Ihren API-Schlüssel und lassen Sie Ihren ersten Regressionstest von Claude Code schreiben. Delta-QA kostenlos testen →
FAQ
Was ist Playwright MCP?
Playwright MCP ist der Server für das Model Context Protocol, den Microsoft für Playwright veröffentlicht hat. Er ermöglicht es einem KI-Agenten wie Claude, einen echten Browser zu steuern, indem er den Accessibility Tree der Seiten liest: eine URL öffnen, klicken, eingeben, Inhalte lesen. Der Agent arbeitet nach Anweisungen in Alltagssprache, ohne Skript.
Kann man mit Playwright MCP Regressionstests durchführen?
Ja, für eine punktuelle Prüfung. Soll ein Test dagegen bei jedem Release laufen, entscheidet der Agent bei jedem Durchlauf jede Aktion neu, sodass zwei Durchläufe zwei verschiedenen Wegen folgen können. Dann muss der Ablauf festgeschrieben werden: als Code für Playwright Test, den das Team pflegt, oder in einem Werkzeug, das ihn identisch wiederholt, wie Delta-QA.
Muss man programmieren können, um den MCP-Server von Delta-QA zu nutzen?
Nein. Sie beschreiben den Ablauf in Alltagssprache, der Agent schreibt die Schritte und Delta-QA spielt sie erneut ab. Das Szenario erscheint anschließend in Delta-QA, lesbar und ohne Code bearbeitbar, wie ein Szenario, das durch Navigieren aufgezeichnet wurde.
Greift ein LLM ein, wenn Delta-QA den Test erneut abspielt?
Nein. Der Agent greift nur bei der Erstellung des Szenarios ein. Die Wiedergaben werden im Browser von Delta-QA ausgeführt und von der deterministischen KI von Delta-QA, die kein LLM ist, mit der Referenz verglichen: Dieselbe Eingabe ergibt immer dasselbe Urteil.
Welche Agenten können sich mit Delta-QA verbinden?
Claude Code verbindet sich mit einem einzigen Befehl. Auch jeder MCP-Client, der einen Remote-Server mit „Streamable HTTP“ und einem Authentifizierungs-Header akzeptiert, kann sich mit Delta-QA verbinden.
Ist der MCP-Server im kostenlosen Konto enthalten?
Ja. API-Schlüssel und der MCP-Server gibt es in jedem Tarif, auch im kostenlosen Konto. Was der Agent auslöst, wird auf das Kontingent Ihres Tarifs angerechnet, als hätten Sie es selbst gestartet.