Neulich hatte ein bekannter Rezensent sinngemäß geschrieben “Gerade ein Spiel gespielt, dass offensichtlich viel zu selten geplaytestet wurde: Die Idee ist dünn und das Spiel macht keinen Spaß.”
Vorweggeschickt: Ich weiß nicht, um welches Spiel es sich handelt -der Rezensent nannte es nicht. Insofern ist dieser Artikel jetzt keine böse Replik auf einen Verriss meiner Spiele oder so.
Der kurze Post auf Bluesky war sicherlich nicht mit Bedacht ausformuliert, ich gehe hier nur deswegen darauf ein, weil er ein fundamentales Missverständniss mit der Bedeutung von “Playtesting” offenlegt: Es gäbe eine direkte Korrelation zwischen Playtesting und Spielequalität (Anmerkung: Das Wort “Spielqualität” ist aus vielen Gründen problematisch, aber darum soll es hier mal nicht gehen).
Natürlich ist Playtesting wichtig. Da gibt es gar keinen Zweifel; es ist schlicht nicht möglich, ein Spiel oder ein Spielkonzept zu beurteilen, ohne es zu spielen. Auch das Solospielen alleine reicht nicht aus, zu sehr ist man in eigenen Ideen und Vorstellungen gefangen – Quasi “Groupthink” mit einer Gruppe aus 1 Person. Auch ist es essentiell, dass man beurteilen kann, wie das Spiel auf Außenstehende wirkt: Ist es ansprechend? Haben andere eine Vorstellung, was zu tun ist? Wie werden Regeln ausgelegt, was wird vergessen, wo sind Stolperstellen, usw. Diese handwerklichen Dinge können nur über Playtesting verbessert werden.
Was Playtesting nicht automatisch verbessert: Das Spiel selbst. Natürlich sollte ein Spieleschaffender merken, wenn etwa die Idee nicht trägt, das merkt man oft aber tatsächlich erst am Tisch. Das Playtesting ist daher auch für den Spieleschaffenden selbst ein Testlauf. Außerdem haben eigentlich die meisten Playtester am Tisch Feedback und auch eigene Ideen. Die Kunst als Spieleschaffender ist aus diesen Vorschlägen diejenigen herauszupicken, die am besten zu eigenen Vorstellung des Spieles passen (diese Vorstellung kann ja durchaus von denen der Testspielenden abweichen). Insofern wird eine Spielidee in der Praxis durch Testspielen natürich in der Regel bereichert, angepasst, verbessert. Doch der Umkehrschluss ist falsch: Durch häufiges Playtesting wird ein Spiel nicht automatisch besser – ich erinnere mich noch an einen Autoren, der eine Zeitlang wöchentlich beim Spieleautprentreffen vorbeischaute und immer dasselbe Kartenspiel präsentierte, welches aber nie zündete. Jede Woche passte er die Kartenwerte oder -anzahlen an oder ergänzte eine Farbe… aber er griff nie in die Regeln selbst ein. Das wäre aber nötig gewesen, um das Spiel zu verbessern. Für die Spieleentwicklung braucht man neben Ideen eben auch kreative Lösungen – nicht umsonst meint Reiner Knizia, dass er Probleme niemals einzelnd angeht, sondern versucht, durch eine Umstellung, mehrere Probleme auf einmal zu lösen. Um zurück auf den Ausgangssatz zu kommen: Eine dünne Spielidee wird nicht automatisch substantieller, wenn mehr getestet wird. Ein herkömmliches Spiel wird nicht automatisch durchs Testen origineller. Beides kann zwar durchs Testen iniiiert werden, es bleibt aber eine Leistung des Spieleschaffenden.
Etwas didaktisch aufbereitet:
Kann durch Playtesting verbessert werden:
- Handling / Übersichtlichkeit
- Regelfragen
- Einseitige Spielstrategien /Fehlende “echte” Optionen
- Produktionsprobleme (Graphikfehler etc.)
Wird durch Playtesting nur indirekt verbessert (durch Vorschläge, etc.):
- Originalität
- Spielidee
- Komplexität
- “Spielspaß” (Eine sehr weiche Größe, da auch abhängig von Zielgruppe, Ansatz, etc.)
“Balancing” ist ein bisschen ein Sonderfall. Ich habe schon häufiger darüber geschrieben (z.B. hier oder gesprochen im Rahmen von Auf ein Wort hier), aber prinzipiell kann man durch Playtesting natürlich Unwuchten im Spiel feststellen, wobei diese Unwuchten auch durch Fehleinschätzungen der Spielenden (“Groupthink”) oder mangelnde Erfahrung (siehe Dominion-Goldstrategie) zustandekommen können (wodurch sie eher Symptom denn Problem wären). Vor allem aber kann man ein Spiel gar nicht so häufig spielen, dass man eine wissenschaftliche Studie über die genaue Verteilungen schreiben könnte. Zum Glück ist das auch nicht notwendig – die Spielenden müssen lediglich das Gefühl haben, dass als gleichwertig wahrgenommene Optionen auch tatsächlich gleichwertig sind und das geschieht durch “gutes” Spieldesign.

Zu der ganzen Gemengenlage kommt auch noch ein weiterer Faktor: Wenn ein Spieleschaffender ein Spiel sehr oft testet und es dann dem Verlag schickt, so testet dieser das Spiel ebenfalls. Wenn der Verlag das Spiel dann nimmt, dann muss er meistens etwas in dem Spiel sehen (natürlich gibt es auch rein betriebswirtschaftliche Gründe, ein Spiel zu produzieren, ohne dass es überzeugt – da sind wir dann bei “Shovelware” oder IPs…). Ist dies der Fall, arbeitet die Redaktion ebenfalls noch einmal an dem Spiel und testet es ebenfalls noch häufig. Auch deswegen ist die Gleichung “Kein Spielspaß”=”Zu wenig Testgespielt” falsch – es sind in der Regel nur Leute anderer Meinung als man selbst.

Ist das Spiel dann produziert, wird aber nicht oder kaum noch ausprobiert. Tatsächlich werden Spiele mit den ganz finalen Regeln nicht mehr so oft getestet, wie in der ganzen Entwicklungszeit. Ein weiterer Blueskypost brachte es auf den Punkt: “Das Schiff von Theseus machte Hunderte von Reisen”. In der Regel sind die Änderungen zwischen Testpartien zumindest in der Endphase infinitesimal, so dass man davon ausgeht, nichts kaputt zumachen. Garantiert ist es nicht, so dass es dennoch immer wieder zu Problemen kommen kann.
Und letztlich: Ein halbwegs erfolgreiches Spiel wird nach Veröffentlichung so viel öfter gespielt, als in der Entwicklungszeit möglich ist, so dass mögliche Fehler (wie der Hallifax Hammer bei A few acres of snow oder die aggressive Spielweise bei Wir sind das Volk) erst jetzt sichtbar werden. Das ist ärgerlich, aber gerade bei hyperspezifischen Strategien kaum dauerhaft zu vermeiden. Umgekehrt wurden nicht alle Varianten bei 504 tatsächlich getestet -schon gar nicht mehrfach – und sie funktionieren m.W. dennoch alle (ob sie alle “gut” sind, darüber erlaube ich mir kein Urteil). Insofern müsste ich Tabelle oben noch weiter verändern – je mehr man tatsächlich buddelt, desto mehr stellt man fest, dass Testrunden und Autorenleistung sich gegenseitig bedingen. So wichtig Testrunden auch sind – und ich will die in keinster Weise kleinschreiben – sie sind ein essentielles Arbeitsmittel, ohne dass es in der Spieleentwicklung nicht geht. Sie sind aber nicht die Arbeit selbst.
ciao
peer
- Playtesting: Eine Geschichte voller Missverständnisse - 27. September 2026
- Gegenmacht und Spiele - 13. September 2026
- Mount Tsundoku und der Stapel des Grauens - 6. September 2026



