Alle Beiträge
KI-Sichtbarkeit·9. Oktober 2026·22 Min. Lesezeit

Prompts für KI-Sichtbarkeit auswählen: was 2.160 KI-Antworten zeigen

Wähle die Prompts, die du trackst, nach Kaufabsicht aus und nicht nach Formulierung. Deck die Phasen ab, in denen Antworten in deiner Kategorie wirklich Marken nennen. Halte Prompts mit Markennamen aus deiner Hauptkennzahl heraus. Behandle jeden Markt als eigenes Set und prüf wöchentlich statt täglich. Das zeigen 2.160 Antworten von ChatGPT, Gemini und Perplexity. Mit ihnen haben wir die Tipps geprüft, die fast jeder Leitfaden wiederholt. Die Leitfäden raten, mit ein paar Dutzend Prompts anzufangen und den ganzen Funnel abzudecken. Sie raten auch, jeden Prompt mehrfach zu formulieren, Personas zu ergänzen, den eigenen Markennamen unterzumischen und das Set auf weitere Märkte zu übertragen. Ein zweiter Durchlauf desselben Prompts änderte die genannten Marken fast so stark wie eine neue Formulierung. Ein Tag Abstand änderte sie nicht stärker. Eine Vorlage zum Ausfüllen und die Daten auf Antwortebene kannst du am Ende kostenlos herunterladen.

Von Philipp Enders·Gründer, CrunchJunkie·LinkedInEntwickelt die Reporting- und KI-Sichtbarkeits-Tools, mit denen diese Analyse erstellt wurde.
Zwei Durchläufe desselben Prompts hatten 55 % ihrer Marken gemeinsam, egal ob Minuten oder ein Tag dazwischen lagen. Bei zwei Formulierungen derselben Absicht waren es 43 %. ChatGPT, Gemini und Perplexity, 8. und 9. Oktober 2026.

Kurz gefasst

Ein Maß zieht sich durch diesen Beitrag: wie viele Marken zwei Antworten gemeinsam haben. Perplexity beantwortete den Keyword-Prompt „sales pipeline tracking“ mit HubSpot, Pipedrive und Zoho CRM. Eine Viertelstunde später lautete die Antwort HubSpot, Salesforce und Pipedrive. Zusammen nannten die beiden Antworten vier Marken, und zwei davon kamen in beiden vor. Die Antworten haben also die Hälfte ihrer Marken gemeinsam. Identische Listen teilen alle Marken, Listen ohne Überschneidung keine. Zwei Durchläufe desselben Prompts auf derselben Engine hatten im Schnitt 55 % ihrer Marken gemeinsam. Zwei Formulierungen derselben Kauffrage kamen auf 43 %, derselbe Prompt auf zwei Engines auf 39 %. Was nach einem Effekt der Formulierung aussieht, entsteht also größtenteils schon bei einer Wiederholung. Ein Tag Abstand änderte daran nichts. Je ein Durchlauf von jedem Tag hatte ebenfalls 55 % der Marken gemeinsam. Keiner von 40 Markenanteilen bewegte sich zwischen den Tagen um mehr als seine Fehlermarge. Awareness-Prompts fragen nach dem Problem eines Käufers. Bei CRM nannten die meisten Antworten darauf Marken. Bei Laufschuhen waren es nur 55 von 216 Antworten, und die meisten Namen waren keine Schuhmarken. Shortlist-Prompts nannten in beiden Kategorien in jeder Antwort Marken. Nennt ein Prompt eine Marke, kommt sie in 83 bis 100 % der Antworten vor. Mit solchen Prompts im Set rückte Brooks im Laufschuh-Ranking von Platz zwei auf Platz eins. Deutsche Antworten nannten andere Marken. Über die Tage hinweg hatten deutsche und US-Antworten 51 % ihrer Marken gemeinsam, die beiden US-Tage 75 %. CentralStationCRM kam in mehr als der Hälfte der deutschen CRM-Antworten vor und in keiner der 864 US-Antworten. Wie viele Prompts du brauchst, hängt davon ab, wie knapp das Rennen ist. Fünf zufällige Prompts fanden fast immer die führende CRM-Marke. Zwei Tage mit 33 Prompts reichten nicht, um Asics und Brooks zu trennen. Bei gleicher Zahl von Prompts sind mehr Absichten besser als mehr Formulierungen.

So haben wir getestet

Wir haben zwei Kategorien gewählt, in denen Käufer sehr unterschiedlich recherchieren. Wer ein CRM sucht, fragt früh nach Tools. Wer Laufschuhe sucht, fängt oft mit einem schmerzenden Knie an. Für jede Kategorie haben wir 16 Kaufabsichten auf US-Englisch formuliert, je vier für vier Phasen. Awareness ist das Problem. Consideration ist die Shortlist. In der Evaluation werden bestimmte Marken verglichen. Bei CRM heißt die letzte Phase Decision. Bei Laufschuhen heißt sie Purchase und fragt, wo man kauft. Jede Absicht gibt es in drei Formulierungen: als einfache Frage, als Keyword-Prompt und als Persona mit Kontext. „Which CRM software is free?“, „free crm software“ und „We're a bootstrapped startup with no budget for software. Which free CRM is good enough to start with?“ sind eine Absicht in drei Formulierungen. Die Persona beschreibt ein Start-up ohne Software-Budget, das ein kostenloses CRM für den Anfang sucht. Für Deutschland haben wir die vier Consideration-Absichten jeder Kategorie auf Deutsch geschrieben, in denselben drei Formen. Zwei Beispiele sind „Welche CRM-Software ist kostenlos?“ und „crm software kostenlos“. ChatGPT, Gemini und Perplexity haben jeden Prompt am 8. Oktober 2026 dreimal beantwortet. Am nächsten Tag lief alles noch einmal. Gezählt haben wir jede Marke, die in einer Antwort vorkam, nicht nur die, die ein Projekt verfolgt. Läden, Apps und Schmerzmittel zählen mit. Neun der 32 US-Absichten nennen schon im Prompt eine Marke, etwa „hubspot vs salesforce“. Diese werten wir getrennt aus.
Der Aufbau der Studie. Jeder Prompt lief am 8. Oktober 2026 und noch einmal am 9. Oktober dreimal auf ChatGPT, Gemini und Perplexity: 1.080 Antworten pro Tag, 2.160 insgesamt.
AufbauUSA, je KategorieDeutschland, je Kategorie
Phasen41 (Consideration)
Absichten164
Formulierungen je Absicht33
Prompts4812
Antworten an zwei Tagen864216
Der Aufbau der Studie. Jeder Prompt lief am 8. Oktober 2026 und noch einmal am 9. Oktober dreimal auf ChatGPT, Gemini und Perplexity: 1.080 Antworten pro Tag, 2.160 insgesamt.

Eine Wiederholung ändert die Antwort fast so stark wie eine neue Formulierung

Wir haben ChatGPT am 8. Oktober dreimal gefragt: „What is the best CRM for a small business?“ Die erste Antwort nannte HubSpot, Salesforce, Pipedrive, Zoho CRM und Freshsales. Die zweite ließ Salesforce weg. Die dritte ließ Freshsales weg. Die Keyword-Version „best crm small business“ brachte zusätzlich monday CRM und Less Annoying CRM ins Spiel. Eine Wiederholung ändert die Liste fast so stark wie eine neue Formulierung. Die meisten Leitfäden raten, jeden Prompt in mehreren Varianten zu tracken. Ihr Argument: Menschen formulieren dasselbe Anliegen unterschiedlich. Wir haben deshalb beides gemessen, die Wirkung einer neuen Formulierung und die einer Wiederholung. Zwei Durchläufe desselben Prompts auf derselben Engine hatten 55 % ihrer Marken gemeinsam. Zwei Formulierungen derselben Absicht kamen auf 43 %. Rund vier Fünftel der Änderung durch eine neue Formulierung entstehen also schon, wenn du einfach noch einmal fragst. Das galt auf jeder Engine und in beiden Kategorien, wie die Tabelle zeigt. Am zeitlichen Abstand lag es auch nicht. Durchläufe mit wenigen Minuten Abstand hatten etwa so viele Marken gemeinsam wie Durchläufe mit 40 bis 70 Minuten Abstand. Unter den drei Formulierungen fiel die Persona aus dem Rahmen. Frage und Keyword-Prompt lagen am nächsten beieinander. Personas nannten außerdem weniger Marken pro Antwort. Bei den Marathon-Prompts nannte jede Antwort auf die einfache Frage und auf den Keyword-Prompt Nike. Bei der Persona, die für ihren ersten Marathon trainiert, waren es nur 10 von 18. Beim einfachsten CRM zeigte HubSpot dasselbe Muster. Es kam in jeder Antwort auf Frage und Keyword-Prompt vor, aber nur in 12 von 18 für ein Team, das sein letztes CRM gehasst hat. Im Grunde stellt eine Persona eine engere Frage, und die hat ihre eigene Antwort. Eine zweite und dritte Formulierung misst deshalb vor allem die Schwankung, die auch eine Wiederholung zeigt. Die erfasst du besser, wenn du jeden Prompt öfter laufen lässt. Mehr vom Markt siehst du mit zusätzlichen Absichten.
Wie viele Marken zwei Antworten gemeinsam hatten, US-Prompts ohne Markennamen, beide Tage. Jeder Wert ist ein Durchschnitt über die Absichten.
Verglichene AntwortenDerselbe Prompt erneut gestelltAndere Formulierung, gleiche Absicht
Alle55 %43 %
CRM62 %48 %
Laufschuhe46 %38 %
ChatGPT64 %52 %
Gemini58 %45 %
Perplexity49 %40 %
Wie viele Marken zwei Antworten gemeinsam hatten, US-Prompts ohne Markennamen, beide Tage. Jeder Wert ist ein Durchschnitt über die Absichten.

Ein Tag Abstand verändert die Antworten nicht stärker als ein paar Minuten

Am 8. Oktober fragten wir Perplexity: „What are the best running shoes for beginners?“ Die Antwort nannte Nike, Brooks, New Balance und Altra, dazu die Shops Zappos und Amazon. Etwa eine halbe Stunde später blieb davon nur Nike übrig. Am nächsten Tag war die erste Antwort fast dieselbe wie die allererste. Nur Zappos fehlte. Ein Tag zwischen zwei Antworten veränderte sie nicht stärker als ein paar Minuten. Am 9. Oktober, etwa 19 Stunden nach dem ersten Scan, haben wir die ganze Studie wiederholt. Wenn ein täglicher Check etwas Echtes misst, müssten sich Antworten von verschiedenen Tagen stärker unterscheiden als Antworten vom selben Tag. Das taten sie nicht. Zwei Durchläufe eines Prompts hatten innerhalb eines Tages 55 % ihrer Marken gemeinsam, mit je einem Durchlauf von jedem Tag ebenfalls 55 %. Auch die Markenanteile blieben stabil. Wir haben 40 davon zwischen den beiden Tagen verglichen. Keiner bewegte sich um mehr als seine Fehlermarge. Die größten Bewegungen in den USA lagen bei 3,2 Punkten, bei monday CRM und Fleet Feet. Auch der Spitzenreiter eines Prompts war nicht stabiler. Wir haben für jeden Prompt und jede Engine die Marke bestimmt, die am ersten Tag am häufigsten vorkam. In 124 von 185 Fällen lag sie auch am zweiten Tag vorn. Teilt man dieselben sechs Antworten anders in zwei Dreiergruppen auf, mit gemischten Tagen, stimmen die Spitzenreiter etwa genauso oft überein. Der Tag zwischen den Scans vergrößert die Uneinigkeit kaum über das hinaus, was schon eine Wiederholung bewirkt. Ein täglicher Check der KI-Sichtbarkeit misst damit vor allem, wie stark Antworten von Durchlauf zu Durchlauf schwanken. Beurteile eine Bewegung an ihrer Fehlermarge und vergleiche Wochen statt Tage. Im September haben wir über zwei Zeiträume gemessen, wie viel Bewegung nur Rauschen ist. Dieser Test deckt nur zwei aufeinanderfolgende Tage ab. Über eine langsame Drift sagt er nichts.
Von Tag zu Tag, 8. und 9. Oktober 2026. Die Markenanteile umfassen die 40 Marken, die an einem der Tage in mindestens 20 Antworten eines Markts und einer Kategorie vorkamen. In den USA gab es pro Kategorie 432 Antworten am Tag, in Deutschland 108.
Was wir verglichen habenErgebnis
Zwei Durchläufe eines Prompts, beide am 8. Oktober55 % gemeinsame Marken
Zwei Durchläufe eines Prompts, beide am 9. Oktober55 % gemeinsame Marken
Je ein Durchlauf von jedem Tag55 % gemeinsame Marken
Markenanteile, die sich über ihre Fehlermarge hinaus bewegten0 von 40
Größter Anstieg in den USAmonday CRM, von 69 auf 83 von 432 Antworten
Größter Rückgang in den USAFleet Feet, von 115 auf 101 von 432 Antworten
Bewegung, die ein Anteil um die 50 % braucht, um als Veränderung zu zählenEtwa 7 Punkte in den USA, etwa 13 in Deutschland
Gleicher Spitzenreiter für Prompt und Engine an beiden Tagen124 von 185
Gleicher Spitzenreiter bei jeder anderen Aufteilung der sechs Antworten64 %
Von Tag zu Tag, 8. und 9. Oktober 2026. Die Markenanteile umfassen die 40 Marken, die an einem der Tage in mindestens 20 Antworten eines Markts und einer Kategorie vorkamen. In den USA gab es pro Kategorie 432 Antworten am Tag, in Deutschland 108.

Die Engine macht mehr aus als die Formulierung

Am 8. Oktober bekamen alle drei Engines denselben Prompt: „I run a 10-person marketing agency. Which CRM should we use?“ Die erste Antwort von ChatGPT nannte HubSpot, Salesforce, Pipedrive, Zoho CRM und Close. Gemini nannte HubSpot, Pipedrive, monday CRM, GoHighLevel und Productive.io. Perplexity nannte nur HubSpot und Zoho CRM. Nur HubSpot kam in allen drei Antworten vor. Welche Engine du fragst, ändert die Liste stärker als die Formulierung der Frage. Auf zwei verschiedenen Engines hatte derselbe Prompt 39 % seiner Marken gemeinsam. Das ist weniger als bei zwei Formulierungen auf einer Engine mit 43 %. Die Engines unterscheiden sich auch darin, wie viel sie sagen. Gemini nannte die meisten Marken pro Antwort, Perplexity die wenigsten. Die Wahl der Engines gehört damit zur Wahl der Prompts. Ein Gesamtwert über drei Engines mischt drei verschiedene Listen. Ändert sich die Mischung, bewegt sich der Wert. Zeig die Werte je Engine neben dem Gesamtwert. Wie derselbe Effekt für eine einzelne Marke aussieht, zeigt unser Beitrag dazu, warum KI-Engines sich über deine Marke uneinig sind.
US-Antworten aus beiden Kategorien über zwei Tage, 576 je Engine. Derselbe Prompt hatte auf zwei Engines bei CRM 46 % seiner Marken gemeinsam, bei Laufschuhen 31 %.
EngineMarken je AntwortAntworten mit mindestens einer Marke
Gemini5,44554 von 576
ChatGPT3,77470 von 576
Perplexity2,59492 von 576
US-Antworten aus beiden Kategorien über zwei Tage, 576 je Engine. Derselbe Prompt hatte auf zwei Engines bei CRM 46 % seiner Marken gemeinsam, bei Laufschuhen 31 %.

Awareness-Prompts nennen bei CRM Marken, bei Laufschuhen selten

Wir haben 18-mal gefragt: „Why do my knees hurt after running?“ ChatGPT nannte in keiner seiner sechs Antworten eine Marke. Die wenigen Namen in den übrigen Antworten waren die Schmerzmittel Advil und Aleve, die Laufladen-Kette Fleet Feet und einmal die Schuhmarke On. Über alle drei Formulierungen nannten 11 von 54 Antworten zu Knieschmerzen eine Marke. Ob Prompts zum Problem Marken nennen, hängt von der Kategorie ab. Die meisten Leitfäden raten, oben im Funnel anzufangen. Dort geht es um das Problem, das ein Käufer hat, bevor er überhaupt eine Marke kennt. Wir haben je Kategorie vier solche Awareness-Absichten formuliert. Ein Beispiel für CRM: „How do small businesses keep track of sales leads?“ Die CRM-Antworten nannten in 175 von 216 Fällen eine Marke. Die Laufschuh-Antworten taten das in 55 von 216. Nannte eine Laufschuh-Antwort doch einen Namen, war es meist keine Schuhmarke. Am ersten Tag wurde Fleet Feet am häufigsten genannt, vor Nike. Einlagen, Socken, eine Lauf-App und Schmerzmittel machten einen großen Teil des Rests aus. Weiter unten im Funnel verschwand der Unterschied. Consideration-, Decision- und Purchase-Prompts nannten fast in jeder Antwort Marken. Die Antworten auf Laufschuh-Kauffragen nannten allerdings Händler etwa so oft wie Schuhmarken. Am ersten Tag kam Fleet Feet in 63 von 108 dieser Antworten vor. Zwei weitere Händler, Road Runner Sports und Zappos, kamen ebenfalls oft vor. Wer Schuhe herstellt, misst mit Kauf-Prompts also zum Teil die Händler, die sie verkaufen. Prüf das, bevor du viele Awareness-Prompts trackst. Nennen die Antworten in deiner Kategorie selten Marken, behalte ein oder zwei zur Beobachtung. Setz den Rest dort ein, wo Antworten Marken nennen.
Awareness-Prompts zu Laufschuhen nannten in 55 von 216 Antworten eine Marke, und die meisten dieser Namen waren keine Schuhmarken. Ab der Shortlist nannte fast jede Antwort Marken.
Antworten mit mindestens einer Marke nach Phase und durchschnittliche Zahl der Marken je Antwort. USA, ChatGPT, Gemini und Perplexity, drei Durchläufe je Prompt an jedem der beiden Tage: 216 Antworten je Zeile. Evaluation-Prompts nennen selbst eine Marke.
PhaseKategorieAntworten mit MarkeMarken je Antwort
Awareness (das Problem)CRM175 von 216 (81,0 %)3,33
Awareness (das Problem)Laufschuhe55 von 216 (25,5 %)0,98
Consideration (die Shortlist)CRM216 von 216 (100 %)4,34
Consideration (die Shortlist)Laufschuhe216 von 216 (100 %)5,00
Evaluation (nennt eine Marke)CRM216 von 216 (100 %)3,72
Evaluation (nennt eine Marke)Laufschuhe209 von 216 (96,8 %)3,55
DecisionCRM215 von 216 (99,5 %)4,59
PurchaseLaufschuhe214 von 216 (99,1 %)5,96
Antworten mit mindestens einer Marke nach Phase und durchschnittliche Zahl der Marken je Antwort. USA, ChatGPT, Gemini und Perplexity, drei Durchläufe je Prompt an jedem der beiden Tage: 216 Antworten je Zeile. Evaluation-Prompts nennen selbst eine Marke.

Ein Prompt mit Markennamen misst diese Marke

Wir haben 18-mal gefragt: „Should a small business choose HubSpot or Salesforce?“ Jede Antwort nannte beide. Die Marke aus dem Prompt kommt in der Antwort wieder vor. Solche Prompts messen vor allem, ob die Engine die Frage wiederholt. Vergleiche und Alternativen sind in Prompt-Sets beliebt: „hubspot vs salesforce“, „salesforce alternatives“, „Is the Nike Pegasus a good running shoe?“. Bei den meisten dieser Prompts kam die genannte Marke in allen 54 Antworten vor. Am niedrigsten lag On. Auf die Frage nach den Nachteilen von On-Laufschuhen nannten 45 von 54 Antworten On. Im Set verschieben solche Prompts das Ranking. Bei den Prompts ohne Markennamen lag Brooks unter den Laufschuhmarken auf Platz zwei. Nimmt man die Prompts dazu, die Brooks und andere Marken nennen, steht Brooks auf Platz eins. Asics fiel von Platz eins auf Platz drei. Dabei hat sich nichts daran geändert, wie die Engines Asics behandeln. Bei CRM blieb die Reihenfolge gleich, weil HubSpot so weit vorn lag. Salesforce legte durch die Prompts mit seinem Namen aber um 4,9 Punkte zu. Tracken solltest du Prompts mit Markennamen trotzdem. Sie zeigen, was eine Engine sagt, wenn jemand gezielt nach dir fragt. Tagge sie und weise sie getrennt von deiner Sichtbarkeitskennzahl aus.
Anteil der US-Antworten, die die jeweilige Marke nennen, bei Prompts ohne Markennamen und bei allen Prompts, dazu ihr Rang unter allen in der Kategorie genannten Marken. Oben Laufschuhmarken (594 und 864 Antworten), darunter CRM (648 und 864). Beide Tage.
MarkeOhne Marke im PromptRangAlle PromptsRang
Asics49,3 % (293)145,8 % (396)3
Brooks45,8 % (272)255,7 % (481)1
Hoka43,4 % (258)345,9 % (397)2
Nike36,9 % (219)533,8 % (292)5
On5,7 % (34)149,4 % (81)13
HubSpot90,4 % (586)190,2 % (779)1
Pipedrive64,8 % (420)362,2 % (537)3
Salesforce50,0 % (324)454,9 % (474)4
Anteil der US-Antworten, die die jeweilige Marke nennen, bei Prompts ohne Markennamen und bei allen Prompts, dazu ihr Rang unter allen in der Kategorie genannten Marken. Oben Laufschuhmarken (594 und 864 Antworten), darunter CRM (648 und 864). Beide Tage.

Deutsche und US-Antworten nennen unterschiedliche Marken

Wir haben in beiden Märkten nach dem besten CRM für kleine Unternehmen gefragt, auf Englisch für die USA und auf Deutsch für Deutschland. Die US-Antworten nannten meist HubSpot, Zoho CRM, Pipedrive und Salesforce. Die deutschen Antworten nannten ebenfalls HubSpot, Pipedrive und Zoho CRM. Die meisten nannten aber auch CentralStationCRM. In keiner US-Antwort der ganzen Studie kam die Marke vor. Jeder Markt bekommt seine eigenen Antworten, mit eigenen lokalen Marken. In Deutschland haben wir dieselben vier Consideration-Absichten je Kategorie gestellt, auf Deutsch. Damit der Vergleich fair bleibt, haben wir nur Scans von verschiedenen Tagen verglichen. Wir haben also die USA an einem Tag mit den USA am anderen Tag verglichen und mit Deutschland am anderen Tag. Dreiergruppen von Antworten hatten zwischen den beiden US-Tagen 75 % ihrer Marken gemeinsam. Zwischen einem US-Tag und einem deutschen Tag waren es 51 %. Manche Marken kamen nur in einem Markt vor. CentralStationCRM, ein CRM aus Deutschland, wurde in 123 von 216 deutschen CRM-Antworten genannt. Kalenji, eine Marke von Decathlon, kam nur in deutschen Laufschuh-Antworten vor. Umgekehrt kamen Less Annoying CRM und Fleet Feet nur in US-Antworten vor. Auch bei den großen Namen verschob sich etwas. Microsoft Dynamics 365 und Adidas kamen in Deutschland deutlich öfter vor, New Balance deutlich seltener. HubSpot blieb fast gleich. Eine Wettbewerberliste für die USA hätte CentralStationCRM nicht enthalten. Dabei kam die Marke in mehr als der Hälfte der deutschen CRM-Antworten vor. Warum der Vergleich über die Tage? Am ersten Tag lagen die deutschen Wiederholungen nur Minuten auseinander, die US-Wiederholungen etwa 40 Minuten. Ein Vergleich am selben Tag hätte beides vermischt. Über die Tage liegen alle Vergleiche zwischen zwei Scans im Abstand von etwa 19 Stunden. Deutschland liegt dabei genauso weit von den USA entfernt wie am ersten Tag.
Consideration-Antworten, die eine Marke nennen, dieselben vier Absichten in beiden Märkten, beide Tage. 216 Antworten je Markt und Kategorie.
KategorieMarkeUSADeutschland
CRMHubSpot210 (97,2 %)205 (94,9 %)
CRMZoho CRM160 (74,1 %)119 (55,1 %)
CRMPipedrive138 (63,9 %)151 (69,9 %)
CRMCentralStationCRM0 (0,0 %)123 (56,9 %)
CRMSalesforce95 (44,0 %)57 (26,4 %)
CRMMicrosoft Dynamics 36515 (6,9 %)42 (19,4 %)
CRMLess Annoying CRM46 (21,3 %)0 (0,0 %)
LaufschuheAsics194 (89,8 %)206 (95,4 %)
LaufschuheBrooks163 (75,5 %)185 (85,6 %)
LaufschuheNew Balance128 (59,3 %)71 (32,9 %)
LaufschuheAdidas49 (22,7 %)94 (43,5 %)
LaufschuheFleet Feet40 (18,5 %)0 (0,0 %)
LaufschuheKalenji0 (0,0 %)26 (12,0 %)
Consideration-Antworten, die eine Marke nennen, dieselben vier Absichten in beiden Märkten, beide Tage. 216 Antworten je Markt und Kategorie.

Wie viele Prompts du brauchst, hängt davon ab, wie knapp das Rennen ist

Bei CRM kam HubSpot in neun von zehn Antworten vor, weit vor Zoho CRM. Bei Laufschuhen kamen Asics, Brooks und Hoka jeweils in knapp der Hälfte der Antworten vor. Einen klaren Spitzenreiter findest du schon mit einer Handvoll Prompts. Ein knappes Rennen entscheidet sich vielleicht nicht einmal mit allen. Leitfäden nennen meist eine Zahl, oft ein paar Dutzend. Wir haben getestet, was eine bestimmte Zahl von Prompts richtig trifft. Dafür haben wir die US-Prompts ohne Markennamen genommen, 36 bei CRM und 33 bei Laufschuhen. Für jede Größe haben wir 500 zufällige Sets gebildet. Dann haben wir zwei Dinge geprüft. Findet ein Set denselben Spitzenreiter wie alle Prompts zusammen? Und ordnet es die Marken fast genauso? Bei CRM setzten beliebige fünf Prompts HubSpot in 493 von 500 zufälligen Sets auf Platz eins. Beliebige zehn schafften das jedes Mal. Das vollständige Ranking brauchte mehr Prompts, und die kleinen Marken am Ende der Liste noch mehr. Wie viele, zeigt die Tabelle. Bei Laufschuhen hatte jede der ersten drei Marken eine Fehlermarge von etwa vier Punkten nach oben und unten. Über zwei Tage liegt Asics 5,9 Punkte vor Hoka. Dieser Abstand reicht gerade, um zu zählen. Asics und Brooks trennen 3,5 Punkte. Selbst mit allen 33 Prompts ließ sich nicht sagen, wer von beiden vorn liegt. Berichte die beiden als gleichauf. Das vollständige Laufschuh-Ranking war leichter zu treffen als das bei CRM. Zehn Prompts reichten, egal welche Markenliste du ordnest. Auch der Sieger eines einzelnen Prompts ist unzuverlässig. Wir haben die drei Durchläufe eines Prompts auf einer Engine an einem Tag als Gruppe betrachtet. In 300 von 414 solchen Gruppen lagen zwei oder mehr Marken beim Spitzenwert gleichauf. Bei so vielen Gleichständen ist der Sieger eines einzelnen Prompts meist Zufall. Lies Prompts deshalb in Gruppen, nach Phase, Absicht oder Markt.
Was zufällige Sets aus US-Prompts ohne Markennamen richtig trafen, 500 zufällige Sets je Größe, beide Tage. „Nah am vollständigen Ranking“ heißt: Das Set ordnete die Marken in neun von zehn Fällen fast so wie alle Prompts zusammen (Rangkorrelation von 0,8 oder besser, 1 ist dieselbe Reihenfolge).
KategoriePrompts je SetWas die Sets trafen
CRM5HubSpot auf Platz eins in 493 von 500 Sets
CRM10HubSpot auf Platz eins in allen 500 Sets
CRM20Nah am vollständigen Ranking der 21 Marken mit mindestens zehn Nennungen
CRM25Nah am vollständigen Ranking aller 37 Marken mit mindestens fünf Nennungen
Laufschuhe10Asics auf Platz eins in 310 von 500 Sets, nah am vollständigen Ranking mit beiden Markenlisten
Laufschuhe20Asics auf Platz eins in 422 von 500 Sets
Was zufällige Sets aus US-Prompts ohne Markennamen richtig trafen, 500 zufällige Sets je Größe, beide Tage. „Nah am vollständigen Ranking“ heißt: Das Set ordnete die Marken in neun von zehn Fällen fast so wie alle Prompts zusammen (Rangkorrelation von 0,8 oder besser, 1 ist dieselbe Reihenfolge).

Bei gleichem Budget sind mehr Absichten besser als mehr Formulierungen

Angenommen, dein Budget reicht für neun Laufschuh-Prompts. Dann kannst du neun Absichten in je einer Formulierung abdecken. Oder du nimmst drei Absichten in allen drei Formulierungen. Wir haben von beiden Varianten je 500 zufällige Sets gebildet. Neun Absichten trafen das vollständige Ranking fast immer ziemlich genau. Drei Absichten in drei Formulierungen lagen etwa jedes zehnte Mal deutlich daneben. Bei CRM zeigte sich mit zwölf Prompts dasselbe Muster, wie die Tabelle zeigt. Das passt zum ersten Ergebnis. Zusätzliche Formulierungen bringen über die normale Schwankung hinaus wenig. Zusätzliche Absichten bringen dagegen Teile des Marktes, die du bisher nicht gemessen hast.
Wie ähnlich ein kleineres Set aus US-Prompts ohne Markennamen die Marken mit mindestens zehn Nennungen ordnete wie das vollständige Set (1 = dieselbe Reihenfolge). 500 zufällige Sets je Zeile: der Wert des typischen Sets und der Wert, den neun von zehn Sets mindestens erreichten. Beide Tage.
KategoriePromptsVerteilungTypisches SetIn neun von zehn Sets mindestens
CRM99 Absichten, je eine Formulierung0,870,78
CRM93 Absichten, je drei Formulierungen0,800,70
CRM1212 Absichten, je eine Formulierung0,910,85
CRM124 Absichten, je drei Formulierungen0,830,73
Laufschuhe66 Absichten, je eine Formulierung0,930,79
Laufschuhe62 Absichten, je drei Formulierungen0,820,52
Laufschuhe99 Absichten, je eine Formulierung0,960,90
Laufschuhe93 Absichten, je drei Formulierungen0,880,66
Wie ähnlich ein kleineres Set aus US-Prompts ohne Markennamen die Marken mit mindestens zehn Nennungen ordnete wie das vollständige Set (1 = dieselbe Reihenfolge). 500 zufällige Sets je Zeile: der Wert des typischen Sets und der Wert, den neun von zehn Sets mindestens erreichten. Beide Tage.

So baust du dein Prompt-Set

1. Fang bei den Absichten an. Schreib für jede Phase auf, mit welchen Anliegen Käufer in deine Kategorie kommen. Gemeint sind das Problem, die Shortlist, die Marken, die sie vergleichen, und wo und wie sie kaufen. Eine Zeile pro Anliegen. Bei gleicher Zahl von Prompts ordneten mehr Absichten die Marken besser als mehr Formulierungen. 2. Prüf den oberen Funnel, bevor du dich festlegst. Stell jeden Awareness-Kandidaten ein paar Mal auf den Engines, die für dich zählen. Nennen die Antworten Marken, behalte die Prompts. Tun sie es selten, behalte ein oder zwei zur Beobachtung und setz den Rest weiter unten im Funnel ein. Bei Laufschuhen nannte nur etwa jede vierte Awareness-Antwort eine Marke. 3. Formuliere jede Absicht einmal, so wie deine Käufer fragen. Eine einfache Frage ist ein guter Standard. Eine Persona lohnt sich nur, wenn die Situation des Käufers verändert, was eine gute Antwort ist. Beispiele sind ein knappes Budget, Plattfüße oder ein Team, das sein letztes CRM gehasst hat. Zähl eine solche Persona als eigene Absicht. Verschwende keine Prompts auf eine Frage- und eine Keyword-Version desselben Anliegens. Schon zwei Durchläufe einer Formulierung haben nur 55 % ihrer Marken gemeinsam. 4. Halte Markennamen aus der Hauptkennzahl heraus. Tagge jeden Prompt, der eine Marke nennt, deine oder die eines Wettbewerbers, und weise ihn getrennt aus. Untergemischt rückten solche Prompts Brooks von Platz zwei auf Platz eins. 5. Bau das Set für jeden Markt aus den Fragen der Käufer dort. Schreib die Prompts in der Landessprache und so, wie Käufer dort fragen. Hinterleg für jeden Prompt Markt und Sprache und nimm lokale Wettbewerber in deine Liste auf. Keine US-Antwort nannte CentralStationCRM, aber mehr als die Hälfte der deutschen CRM-Antworten. 6. Frag öfter als einmal und auf mehr als einer Engine. Lass jeden Prompt pro Engine mehrmals laufen. Berichte den Anteil über alle Durchläufe mit der Zahl der Antworten dahinter. Zeig die Werte je Engine neben jedem Gesamtwert. Derselbe Prompt hatte auf zwei Engines nur 39 % seiner Marken gemeinsam. Welche Kennzahlen du berichten solltest, beschreibt unser Beitrag zu KI-Sichtbarkeits-Metriken. 7. Richte die Größe des Sets danach, wie knapp das Rennen ist. Fang mit einem Prompt pro Absicht an, lass das Set laufen und sieh dir die Abstände zwischen den Marken an, die dich interessieren. Einen Spitzenreiter mit großem Vorsprung findet schon eine Handvoll Prompts. Marken mit wenigen Punkten Abstand trennen sich vielleicht gar nicht. Dann liegen sie ehrlich berichtet gleichauf. Brauchst du auch die Reihenfolge der kleinen Marken, plane mehr Prompts ein. 8. Werte Prompts in Gruppen aus. Berichte nach Phase, Absicht, Markt und Engine, nicht danach, wer Prompt 14 gewonnen hat. In den meisten Dreiergruppen von Antworten auf einen Prompt lagen zwei oder mehr Marken beim Spitzenwert gleichauf. 9. Prüf wöchentlich und miss jede Veränderung an ihrer Fehlermarge. Ein wöchentlicher Rhythmus reicht, um echte Bewegungen zu sehen. Tägliche Daten zeigen vor allem, wie stark Antworten von Durchlauf zu Durchlauf schwanken. Keiner von 40 Markenanteilen bewegte sich von einem Tag zum nächsten über seine Fehlermarge hinaus. 10. Halte das Set schriftlich fest und lass es dann in Ruhe. Trag es in die Vorlage unten ein, eine Zeile pro Prompt, mit Phase, Formulierung und Absicht als Tags. Dann ändere es ein paar Wochen lang nicht. Jeder Prompt, den du hinzufügst oder streichst, verändert, woraus sich die Hauptkennzahl zusammensetzt.

Downloads

Drei Dateien, frei nutzbar unter CC BY 4.0. Nenn CrunchJunkie als Quelle und verlinke diese Seite. Die Prompt-Vorlage ist eine CSV-Datei mit einer Zeile pro Prompt und sechs Beispielzeilen. Ihre Spalten heißen prompt, tags, category, intent, market, language und active. Tags stehen in einer Zelle, getrennt durch Semikolons: „stage: consideration; wording: question; intent: free crm“. Die Präfixe sind optional. Für category gibt es vier Werte. Nimm discovery für eine offene Frage zur Kategorie, brand, wenn der Prompt deine Marke nennt, competitor, wenn er einen Wettbewerber nennt, oder shopping. Die Spalte intent meint die Suchintention und darf leer bleiben. Die Kaufabsichten dieser Methode stehen in den Tags. Die 120 Prompts der Studie liegen im selben Format vor, mit unseren Tags. US- und deutsches Set stehen in einer Datei. Der Datensatz auf Antwortebene hat eine Zeile pro Antwort, 2.160 Zeilen für beide Tage. Jede Zeile enthält den Prompt mit Phase, Formulierung und Absicht und die Angabe, ob er eine Marke nennt. Dazu kommen Engine, Tag, Durchlauf, Uhrzeit und die Marken, die in der Antwort vorkamen. Die Antworttexte sind nicht enthalten. Die Vorlage folgt dem Importformat von CrunchJunkie, dem Tool, das wir entwickeln und mit dem wir diese Studie durchgeführt haben. Dort importierst du sie unter Prompts → Importieren. Die Einrichtung Schritt für Schritt steht in unserer Doku. Eine Tabellenkalkulation tut es genauso.

Was diese Studie nicht zeigt

Die Studie umfasst zwei aufeinanderfolgende Tage, den 8. und 9. Oktober 2026. Jeder Prompt lief pro Tag dreimal auf drei Engines. Über eine Drift über Wochen oder Monate sagen zwei Tage nichts. Claude, Googles AI Overviews und AI Mode, Copilot und die übrigen Engines waren nicht dabei. Jede Engine wechselt ihr Modell ohne Ankündigung. Die zwei Kategorien haben wir ausgewählt, weil sie sich unterscheiden. Deine kann sich wie eine von beiden verhalten oder wie keine. Deutschland haben wir nur in der Consideration-Phase getestet. Die Markenlisten stammen aus einer automatischen Extraktion. Wir haben sie unverändert übernommen und die 2.160 Antworttexte für diese Studie nicht noch einmal gegengelesen. Die Position in der Antwort haben wir nur für die Marke erfasst, für die das jeweilige Projekt angelegt war, also HubSpot oder Nike. Alle Zahlen hier messen deshalb, ob eine Marke genannt wurde, und nicht, an welcher Stelle. Die Ergebnisse zur Zahl der Prompts vergleichen kleinere Sets mit unserem eigenen vollständigen Set. Das ist selbst nur eine mögliche Auswahl. Eine hohe Übereinstimmung damit ist eine Obergrenze. Sie belegt nicht, dass ein kleineres Set richtig liegt. Zwei getrennte Sets von je 10 CRM-Prompts stimmten untereinander schlechter überein als jedes der beiden mit dem vollständigen Set.

Häufige Fragen

So viele, dass die wichtigen Kaufabsichten abgedeckt sind, und mehr, wo das Rennen knapp ist. In unserem Test fanden fünf zufällige CRM-Prompts den klaren Spitzenreiter in 493 von 500 zufälligen Sets. Bei Laufschuhen reichten zwei Tage mit 33 Prompts nicht, um Asics und Brooks zu trennen.

Meist nicht. Zwei Durchläufe desselben Prompts hatten 55 % ihrer Marken gemeinsam, zwei Formulierungen derselben Absicht 43 %. Der Unterschied zwischen Formulierungen entsteht also größtenteils schon durch die Wiederholung. Steck das Budget lieber in mehr Absichten.

Nein. Nannte ein Prompt eine Marke, kam sie in 83 bis 100 % der Antworten vor. Mit solchen Prompts im Set rückte Brooks im Laufschuh-Ranking von Platz zwei auf Platz eins. Tracke sie getrennt.

Als Ausgangspunkt ja, aber werte den Markt separat aus. Über die Tage hinweg hatten deutsche und US-Antworten 51 % ihrer Marken gemeinsam, zwei US-Tage 75 %. Ein deutsches CRM kam in 123 von 216 deutschen Antworten vor, aber in keiner der 864 US-Antworten.

Wöchentlich reicht. Antworten im Abstand eines Tages hatten 55 % ihrer Marken gemeinsam, genauso viel wie Antworten im Abstand von Minuten. Keiner von 40 Markenanteilen bewegte sich zwischen den Tagen über seine Fehlermarge hinaus.

Weiterlesen

Sieh die KI-Sichtbarkeit deiner eigenen Marke

Reporting und KI-Sichtbarkeit in einer Konsole — erstell deinen ersten Bericht und Scan in der 14-tägigen Testphase.

14 Tage testen