Wir haben kürzlich bei einem B2B-Softwareanbieter ihre 130 getrackten Prompts durchgesehen. Das Ergebnis: Nur 80 davon hatten irgendeine Aussagekraft.
Das Prompt Set ist die Datengrundlage für alles, was danach kommt. Wer darin sein eigenes Wording abfragt, bekommt gute Zahlen zurück und optimiert danach zwölf Monate in die falsche Richtung.
Ich zeige dir die drei Fehler, die uns beim Prompt Tracking immer wieder auffallen, wie du sie bei dir selbst prüfst, und die sechs Bausteine, mit denen wir ein Set aufbauen, das abbildet, wie Käufer tatsächlich fragen.
Was ist ein Prompt Set?
Fast alle behandeln das Prompt Set wie eine Keyword-Liste in neuer Verpackung. Das ist es aber nicht, denn es gibt keine harten Indikationen darunter, wie zum Beispiel Suchvolumen, und dementsprechend kann man sich das frei erfinden
Gleichzeit legst du damit fest, was gemessen wird. Der Wettbewerbsvergleich, die Quellenanalyse, die Maßnahmenliste, das Budget für das nächste Jahr. Alles hängt an dieser einen Liste.
Wenn die Liste schief ist, ist der Rest sauber gerechneter Unsinn.
Ich vergleiche das gerne mit einer Prüfung. Du schreibst dir die Fragen selbst, korrigierst selbst, und bist dann zufrieden mit der Note. Das Ergebnis stimmt sogar. Es sagt nur nichts darüber aus, ob du den Stoff beherrschst.
Fehler eins: Du fragst dein eigenes Vokabular ab.
Das ist der häufigste Fehler.
Bei einem Mittelständler war die meistzitierte URL eine Seite zu einem Begriff, den das Unternehmen selbst besetzen wollte. Auf dem Dashboard sah das nach starker Sichtbarkeit aus. Wie ist das passiert? Das Prompt Set war aus der Website heraus gebaut worden, also hat es die Website bestätigt.
Ich weiß, wie so etwas entsteht, weil es mir selbst passiert ist. Ich mache seit über zehn Jahren Videos zu diesen Themen und ich habe unser eigenes erstes Prompt Set aus meinem eigenen Sprachgebrauch gebaut. Wir waren wahnsinnig sichtbar. Für Begriffe, die unsere Kunden gar nicht verwenden.
In der Softwarebranche ist das besonders ausgeprägt, weil dort viele Anbieter ihre eigene Produktkategorie erfunden haben. Der Begriff steht in der Navigation, im Pitchdeck, auf der Messewand. Der Einkäufer im Mittelstand kennt ihn nicht.
Der Test dafür ist simpel. Nimm dein Set, und streiche jeden Prompt, in dem ein Begriff vorkommt, den du selbst geprägt hast.
Fehler zwei: Du misst Wissensfragen statt Anbieterfragen.
Der zweite Fehler ist noch verführerischer, weil er sich so richtig anfühlt.
In vielen Sets stecken Definitionsfragen und Anleitungsfragen. Was ist X, wie mache ich Y. Diese Prompts landen in einer Phase, in der es höchstens zu einer Quellennennung kommt, wenn man glück hat, dass überhaupt zitiert wird und nicht nur aus den Trainingsdaten geantwortet wird.
Zu einer Empfehlung kommt es dort nicht.
Für B2B-Software gibt es dazu inzwischen belastbare Zahlen. G2 hat im März 2026 über tausend B2B-Entscheider befragt. Über zwei Drittel starten mit einer Kategorie- oder Wettbewerberfrage. Nur einer von fünf startet mit Fragen zu Anforderungen oder Prozessen. Der häufigste Grund für Chatbot-Nutzung in der Softwarerecherche ist der Vergleich von Anbieterstärken und -schwächen.
Dein Käufer kommt also mit kommerzieller Absicht in den ersten Prompt. Er lässt sich nicht erklären, was Personalmanagement ist. Er will wissen, wer es für ein Unternehmen seiner Größe am besten löst.
Wenn dein Set das nicht abfragt, weißt du am Ende sehr genau, wie sichtbar du an der Stelle bist, an der kein Geld liegt.
Das heißt nicht, dass Top-of-Funnel-Inhalte wertlos sind. Aus SEO-Sicht können die weiterhin Sinn machen. Für die Frage, ob du empfohlen wirst, bringen sie dir nichts.
Fehler drei: Du fragst dieselbe Sache fünfmal.
Der dritte Fehler ist der unauffälligste.
Viele Sets enthalten dieselbe Frage in fünf Formulierungen. Das fühlt sich nach Gründlichkeit an. Es verzerrt aber das Gesamtbild, egal wie gut du danach taggst.
Bei einem Thema, in dem du stark bist, zieht deinen Gesamtwert nach oben. Bei einem Thema, in dem du schwach bist, zieht ihn nach unten. Beides hat nichts mit deiner echten Position zu tun.
Wer daraus einen Trend ableitet, hat eine Umfrage gemacht, in der dieselbe Person fünfmal geantwortet hat.
Warum bilden kurze Prompts die Realität schlecht ab?
Jetzt kommt der Punkt, an dem die meisten gängigen AI Visibility Tools an ihre Grenze stoßen.
Ein großer Teil der gängigen Prompt-Tracking-Tools lässt nur sehr kurze Prompts zu, bis zu 200 Zeichen. Sie passt leider nicht zu dem, was Käufer tatsächlich tun.
Aus derselben G2-Befragung: 44 Prozent greifen bewusst zu Thinking- oder Reasoning-Modellen, wenn die Entscheidung wichtig ist. 41 Prozent nutzen Deep-Research-Werkzeuge regelmäßig. Nur 6 Prozent nutzen sie nie.
Wir können davon ausgehen, das sie hier lange, kontextreiche Anfragen mit Branche, Unternehmensgröße, bestehendem Systemumfeld und Ausschlusskriterien stellen. Ein Einkäufer, der ein passendes ERP recherchiert, tippt keine vier Wörter. Wer solche Situationen mit vier Wörtern nachbaut, misst ein Verhalten, das immer weniger wird.
Wir tracken deshalb auch sehr lange Prompts. Der Aufwand lohnt sich, weil du dabei nicht nur siehst, ob du vorkommst, sondern ob du wirklich in dem für dich passenden Kontext empfohlen wirst.
Wie prüfst du, ob dein Set die Realität abbildet?
Vier Quellen. Die erste ist mit Abstand die wertvollste und wird am seltensten genutzt.
Echte Kundengespräche
Kundeninterviews, transkribierte Sales-Calls, Onboarding-Gespräche, Support-Tickets. Überall dort, wo mit echten Kunden gesprochen wurde und Daten vorliegen. Das ist die einzige Quelle, in der die Sprache deiner Zielgruppe im Original steht, mit ihren Begriffen, ihren Umschreibungen und ihren falschen Bezeichnungen für dein Produkt.
Die meisten Unternehmen sitzen auf diesem Material und wissen es nicht. Wer seine Calls mitschneidet, hat Hunderte Stunden Zielgruppensprache in einem Ordner liegen. Genau daraus baut man ein Prompt Set.
Ein Beispiel aus einem Projekt: Das Unternehmen hat sein Produkt konsequent über den Funktionsumfang beschrieben. In den Gesprächen haben Interessenten fast immer über eine Konsequenz gesprochen, konkret über Prüfungssicherheit. Kein einziger Prompt im bestehenden Set enthielt dieses Wort.
Dein eigener Vertrieb
Der weiß, welche Einwände kommen, wo Interessenten hängen bleiben und welche Anbieter im Gespräch genannt werden. Das ist die zweitbeste Quelle, weil hier Erinnerung und Interpretation dazwischenliegen. Vier oder fünf kurze Interviews mit Sales und Marketing reichen, und protokolliert die Formulierungen wörtlich.
Die Bing Webmaster Tools
Dort siehst du Suchanfragen, die ausgelöst werden, um eine Nutzerfrage zu beantworten. Das ist nicht der Prompt selbst, es ist die Zerlegung des Prompts in Suchanfragen. Damit bekommst du echte Formulierungen statt geratener. Es gibt noch weitere Quellen für den Query Fanout, aber das ist schon mal sehr wertvoll.
Personas und Customer Journey Maps
Meistens liegen die irgendwo und werden nie verwendet. Für ein Prompt Set sind sie brauchbar, weil dort die Rollen und die Kaufphasen schon stehen. Prüf aber, wie alt sie sind. In einem Markt, in dem sich das Rechercheverhalten innerhalb von sieben Monaten messbar verschiebt, ist eine Persona von 2022 ein historisches Dokument.
Die sechs Bausteine für ein belastbares Set
So bauen wir das auf:.
- Die strategischen Fragen, die du beantworten willst. Nicht die Prompts. Die Fragen. Willst du wissen, ob du in einem Branchensegment wächst, dann muss das Set das später hergeben.
- Alle verfügbaren Daten zur Zielgruppe zusammentragen. Gesprächstranskripte, Sales-Interviews, Personas, Suchdaten.
- Daraus das Set ableiten, in der Sprache der Zielgruppe, mit Schwerpunkt auf den Situationen, in denen Anbieter empfohlen werden.
- Kategorisieren. Nach Rolle, Kaufphase, Produkt, Funktion, Branche. Ohne diesen Schritt kannst du später keine Frage beantworten, die dir die Geschäftsführung stellt.
- Marken und Wettbewerber sauber definieren, auch die, die du nicht als Konkurrenz siehst, die aber um dieselben Antworten konkurrieren.
- Die einzelnen Produkte und Leistungen abbilden. In der Softwarebranche konkurrieren Wettbewerber oft nur in einer Dimension mit dir, und das siehst du nur, wenn du es trennst.
Ein Hinweis, weil die Frage sicher kommt: Ihr dürft ein paar Prompts mittracken, die der Geschäftsführung wichtig sind. Nur bitte getrennt auswerten und wissen, dass sie eine andere Funktion haben.
Ein gutes Prompt Set macht deine Zahlen oft erst einmal schlechter. Genau das ist der Punkt.
Kommentieren