PR Erfolgsmessung KI: 5 Kennzahlen, die Ihre Pressearbeit belegen, wenn Reichweite allein nichts mehr aussagt
PR Erfolgsmessung mit KI: Ihr Bericht zeigt Reichweite, Ihr Kunde fragt einen KI-Assistenten
Die Quartalsauswertung der Pressestelle weist zwölf Veröffentlichungen und eine Bruttoreichweite in Millionenhöhe aus. Am selben Tag tippt ein Einkäufer seine Frage in einen KI-Assistenten und bekommt drei Anbieter genannt. Ihr Unternehmen ist nicht dabei. Beide Zahlen stimmen, sie messen nur verschiedene Dinge. Für diesen Beitrag haben wir 32 deutsche Medienmarken geprüft: 15 von ihnen lassen die Abrufprogramme der KI-Anbieter gar nicht erst auf ihre Inhalte zugreifen.
1. Einführung: PR Erfolgsmessung mit künstlicher Intelligenz
Eine Pressestelle im Maschinenbau legt ihren Jahresbericht vor. Zweiundvierzig Veröffentlichungen, davon acht in Fachmedien, Tonalität überwiegend positiv. Die Geschäftsführung nickt das Budget durch und stellt am Ende eine einzige Frage: Kommen wir eigentlich vor, wenn jemand eine KI danach fragt? Darauf gibt diese Auswertung keine Antwort, denn er misst, was veröffentlicht wurde, nicht, was abrufbar ist. Wie ein System aus vielen möglichen Quellen genau eine auswählt, beschreibt der Beitrag zu den Signalen hinter der Quellenwahl.
Auf einen Blick
15 von 32
geprüften deutschen Medienmarken sperren mindestens ein Abrufprogramm der KI-Anbieter aus (Hubert-Strategies-Stichprobe)
39 %
der deutschen Online-Nutzenden haben binnen 30 Tagen einen KI-Assistenten zur Informationssuche verwendet (YouGov)
36 %
vertrauen den Angaben eines KI-Assistenten, Suchmaschinen erreichen 72 Prozent (YouGov)
PR Erfolgsmessung mit KI ist die Auswertung von Presse- und Öffentlichkeitsarbeit, die neben Veröffentlichungen und Reichweite auch erfasst, ob eine Marke in den Antworten von KI-Systemen vorkommt. Sie stützt sich auf fünf Kennzahlen: Erwähnungsrate, Quellenanteil der eigenen Domain, Abrufbarkeit der Clippings, Richtigkeit der Aussagen über die Marke und Beitrag zur Wertschöpfung.
Was das für Sie heißt: Ihre Pressearbeit hat bisher gezählt, wie oft über Sie geschrieben wurde. Diese Zahl bleibt richtig, sie wird nur unvollständig. Ein wachsender Teil Ihrer Kundschaft liest die Artikel nicht mehr selbst, sondern lässt sich das Ergebnis zusammenfassen. Ob Ihr Betrieb in dieser Zusammenfassung auftaucht, steht in keiner Ihrer bisherigen Auswertungen. Genau diese Lücke schließen die fünf Kennzahlen in diesem Beitrag.
Wie groß dieser zweite Kanal in Deutschland inzwischen ist, zeigt eine Befragung unter deutschen Online-Nutzenden: 39 Prozent haben binnen 30 Tagen einen KI-Assistenten zur Informationssuche verwendet. Suchmaschinen bleiben mit 79 Prozent vorn. Beim Vertrauen ist der Abstand noch deutlicher: 36 Prozent gegenüber 72 Prozent.
Der Reihe nach: Zuerst kommt die Bewertungsmethodik, danach die fünf Kennzahlen einzeln, dann unsere eigene Position und eine Checkliste für die nächsten vier Wochen. Gerade Startups mit kleinem Kommunikationsbudget profitieren davon, früh die richtigen Größen zu erheben.
2. So haben wir die Kennzahlen bewertet
Eine Rangfolge ohne Maßstab ist Geschmackssache. Deshalb zuerst der Maßstab. Grundlage ist der Bezugsrahmen für Kommunikations-Controlling. Herausgeber sind die Deutsche Public Relations Gesellschaft und der Internationale Controller Verein. Er ordnet jede Größe einer Wirkungsstufe zu: interner Output, externer Output, direkter Outcome, indirekter Outcome und Outflow, also der Beitrag zur Wertschöpfung. Clippings, Reichweite und Share of Voice stehen dort im externen Output, ganz unten in der Kette.
Drei Anforderungen musste eine Kennzahl erfüllen, um in diese Liste zu kommen. Sie muss ohne Vertragsabschluss mit einem Anbieter erhebbar sein. Sie muss über die Zeit vergleichbar bleiben. Und sie muss eine Entscheidung auslösen können, statt nur ein Feld in der Auswertung zu füllen. Die Reihenfolge ergibt sich aus dem Aufwand: Kennzahl 1 lässt sich an einem Nachmittag erheben, Kennzahl 5 braucht die Mitarbeit des Vertriebs.
Die Begriffe dahinter sind nicht neu. Evaluation, also die geordnete Bewertung von PR-Maßnahmen, gehört seit Jahrzehnten zur Unternehmenskommunikation, ebenso die Key Performance Indicators, kurz KPIs. Neu ist allein der Kanal, in dem gemessen wird. Die Metriken ändern sich, der Anspruch bleibt. Und die Messbarkeit steht und fällt weiterhin damit, ob die Kommunikationsziele vorher schriftlich festgehalten wurden.
|
Wirkungsstufe |
Klassische Kennzahl |
Ergänzung für KI-Antworten |
|---|---|---|
|
Externer Output |
Clippings, Bruttoreichweite, Share of Voice |
Erwähnungsrate und Quellenanteil in KI-Antworten (Kennzahlen 1 und 2) |
|
Direkter Outcome |
Verweildauer, Recall, Klicks aus der Berichterstattung |
Abrufbarkeit der Clippings und Richtigkeit der Aussagen (Kennzahlen 3 und 4) |
|
Outflow |
Anzeigenäquivalenzwert, geschätzter Werbewert |
Anfragen mit belegbarem Bezug zur Berichterstattung (Kennzahl 5) |
Eine Größe fehlt in dieser Tabelle bewusst. Der Anzeigenäquivalenzwert steht zwar noch in vielen Auswertungen, der internationale Messstandard der Branche hat ihn aber verworfen. In den Barcelona Principles heißt es dazu:
„Ungültige Messgrößen wie Anzeigenäquivalenzwerte sollten nicht verwendet werden. Bewerten Sie den Beitrag der Kommunikation stattdessen anhand von Ergebnis und Wirkung.“
(„Invalid measures such as advertising value equivalents (AVEs) should not be used. Instead measure and evaluate the contribution of communication by its outcome and impact.“, AMEC, Barcelona Principles in der vierten Fassung)
Dieselbe Quelle führt sieben weitere Bezeichnungen für dieselbe Rechnung auf und nennt sie „Varianten derselben fehlerhaften Messgröße“. Wer die Zahl trotzdem ausweist, sollte ihre Grenzen in der Auswertung benennen.
3. Kennzahl 1: Die Erwähnungsrate in KI-Antworten
Die Erwähnungsrate gibt an, in wie vielen von hundert gleichlautenden Testfragen Ihr Unternehmen in der Antwort genannt wird. Sie ist die Übersetzung des Share of Voice in die neue Umgebung und die einzige Größe, die ein Team ohne fremde Werkzeuge selbst erheben kann. Zwanzig Fragen, die Ihre Zielgruppe wirklich stellt. Fünf Durchgänge je Frage. Vier Systeme: ChatGPT, Claude, Gemini und Perplexity. Das ergibt vierhundert Datenpunkte und eine Ausgangsmessung.
Klassisches Monitoring, also die laufende Medienbeobachtung, deckt diesen Teil nicht ab. Die gängigen Analysetools erfassen Artikel, nicht Antworten. Ein eigenes KI-Tool ist für den Einstieg nicht nötig, eine Tabelle genügt.
Wichtig ist die Wiederholung. Antworten schwanken zwischen zwei Durchläufen derselben Frage erheblich, deshalb sagt eine einzelne Abfrage nichts. Erst der Anteil über viele Durchgänge wird belastbar. Einmal sauber festgelegt, lassen sich dieselben Fragen quartalsweise wiederholen. Das ergibt eine Zeitreihe. Dem alten Reichweiten-Diagramm ist sie durchaus ebenbürtig.
Ein Hinweis zur Auswahl der Fragen. Marken-Fragen wie „Was macht Firma X?“ sind schnell beantwortet und wenig aussagekräftig. Interessant sind Kategorie-Fragen ohne Ihren Namen, also genau die, mit denen ein Einkäufer seine Suche beginnt. Dort entscheidet sich, ob Ihre Pressearbeit auf KI Antworten einzahlt oder nur die eigene Website bespielt.
4. Kennzahl 2: Der Quellenanteil Ihrer eigenen Domain
Die zweite Kennzahl zählt nicht die Nennungen, sondern die Belege darunter. Viele KI-Systeme führen die verwendeten Quellen mit auf. Der Quellenanteil misst, wie oft Ihre eigene Domain oder ein Medium mit Ihrer Meldung in dieser Liste steht. Er unterscheidet sich von der Erwähnungsrate an einer entscheidenden Stelle: Eine Nennung ohne Beleg stammt aus dem Gedächtnis des Modells, eine Nennung mit Beleg aus einem aktuellen Abruf.
Für die Pressearbeit ist das die eigentlich interessante Größe. Sie zeigt, welche Ihrer Veröffentlichungen tatsächlich als Quelle dienen. In der Praxis sind das selten die Meldungen mit der größten Bruttoreichweite. Häufiger tragen Fachbeiträge mit konkreten Zahlen, benannten Fachleuten und einem klaren Datum. Wer wissen möchte, warum Erwähnungen inzwischen mehr wiegen als Verweise, findet die Argumentation im Beitrag zu Erwähnung statt Backlink.
Der Klick als Erfolgsnachweis verliert dabei an Bedeutung. Ob jemand die genannten Quellen anschließend öffnet, bleibt ihm überlassen; ein Teil bleibt in der Antwort. Ihre Web-Analyse sieht davon nichts. Das ist kein Messfehler, sondern eine Verschiebung des Kanals.
Belege schaffen, die im Quellenpool landen
Internationale Pressemitteilungen bringen Ihre Fakten in Medien, die von KI-Systemen abgerufen werden dürfen. Mit Zahlen, Zitaten und Datum an der richtigen Stelle.
5. Kennzahl 3: Die Abrufbarkeit Ihrer Clippings
Diese Kennzahl kennt außerhalb der KI-Welt niemand, und sie ist die unangenehmste der fünf. Sie misst, welcher Anteil Ihrer Veröffentlichungen für ein KI-System überhaupt erreichbar ist. Jede Website kann in einer kleinen Textdatei namens robots.txt festlegen, welche Programme ihre Inhalte abrufen dürfen. Viele Verlage nutzen das und sperren die sogenannten Crawler aus, also die Abrufprogramme der KI-Anbieter.
Wie verbreitet das ist, haben wir für diesen Beitrag gemessen. Aus dem offenen Wissensnetz Wikidata wurden alle deutschen Zeitungen und Publikumszeitschriften mit eigener Website gezogen. Sortiert nach Domain, ausgewählt wurde systematisch jede zweite. Von 40 Marken lieferten 32 eine auswertbare robots.txt. Das Ergebnis: 15 dieser 32 Medien sperren mindestens eines der 24 geprüften Abrufprogramme vollständig aus. 11 sperren gleich fünf große Namen auf einmal. Im Einzelnen: GPTBot von OpenAI und CCBot je 15 Mal, ClaudeBot von Anthropic und PerplexityBot je 13 Mal, Google-Extended 12 Mal.
Für Ihren Medienspiegel heißt das: Ein Teil Ihrer Clippings zählt in der Reichweite voll mit und steht den KI-Systemen trotzdem nicht direkt zur Verfügung. Auftauchen kann Ihre Marke dann immer noch, etwa weil ein anderes Medium die Meldung aufgreift. Verlassen sollte man sich darauf eher nicht. Die praktische Folge ist unspektakulär: Prüfen Sie diese Datei bei Ihren zehn wichtigsten Zielmedien einmal jährlich und gewichten Sie den Medienspiegel entsprechend.
Die Sperren haben für die Verlage einen Preis. Zwei Wirtschaftswissenschaftler der Rutgers Business School und der Wharton School haben 30 Zeitungsverlage über mehrere Jahre beobachtet. Wer die Abrufprogramme aussperrte, verlor binnen sechs Wochen rund 7 Prozent seiner wöchentlichen Besuche, gemessen über zwei unabhängige Datenquellen. Rund drei Viertel der großen Anbieter sperrten dennoch.
6. Kennzahl 4: Die Richtigkeit der Aussagen über Ihre Marke
Tonalität war in der klassischen Medienbeobachtung eine Frage der Färbung: positiv, neutral, negativ. In KI-Antworten kommt eine zweite Frage dazu, und sie wiegt schwerer. Stimmt überhaupt, was dort über Sie steht? Gründungsjahr, Standort, Leistungsspektrum, Geschäftsführung: All das wird aus verschiedenen Quellen zusammengesetzt, und veraltete Angaben halten sich hartnäckig.
Die Erhebung ist einfach. Notieren Sie zehn Kernaussagen über Ihr Unternehmen, die stimmen müssen. Fragen Sie diese in vier Systemen ab und markieren Sie jede Abweichung. Der Anteil korrekter Aussagen ist Ihre Kennzahl. Zwei Vorteile hat sie: Sie ist auch Nichtfachleuten sofort verständlich, und sie liefert eine Aufgabenliste gleich mit.
Der Hebel dahinter ist selten die nächste Pressemitteilung. Meist fehlen eindeutige Angaben auf der eigenen Website oder in öffentlichen Verzeichnissen. Genau dort setzt die Optimierung des Wissensnetzes an, die dafür sorgt, dass Ihre Marke sauber zugeordnet wird. Eine falsche Angabe zu korrigieren kostet meist weniger Zeit, als eine neue Veröffentlichung zu erreichen.
7. Kennzahl 5: Der Beitrag zur Wertschöpfung
Die fünfte Kennzahl beantwortet die Frage der Geschäftsführung. Sie zählt Anfragen, bei denen ein Bezug zur Kommunikation belegbar ist. Nicht geschätzt, nicht hochgerechnet, sondern erfragt. Eine zusätzliche Zeile im Anfrageformular genügt oft, ergänzt um eine Frage im Erstgespräch: Wie sind Sie auf uns gekommen? Die Antwort „ChatGPT hat Sie empfohlen“ taucht dort inzwischen auf.
Diese Größe ersetzt den Return on Investment, kurz ROI, nicht. Sie macht ihn ehrlicher. Kommunikation wirkt selten linear und selten sofort, und der Weg vom ersten Kontakt bis zur Anfrage führt über viele Stationen der Customer Journey, also der Abfolge von Berührungspunkten bis zur Entscheidung. Über die Effektivität einer einzelnen Meldung sagt die Kennzahl wenig, über die Richtung der PR-Arbeit einiges. Belastbar wird die Zahl erst über mehrere Quartale. Genau deshalb steht sie am Ende der Liste und nicht am Anfang.
Ein praktischer Hinweis für die Abstimmung mit dem Vertrieb: Halten Sie die Kategorien grob. Drei Antwortmöglichkeiten, die jeder versteht, bringen mehr als zwölf trennscharfe, die niemand ausfüllt. Ein Audit der KI-Sichtbarkeit liefert für den Start die Ausgangswerte, gegen die Sie später vergleichen.
8. Unsere Position: Was die meisten Ratgeber zur PR Erfolgsmessung übersehen
Die Fachbeiträge zu diesem Thema sind sich weitgehend einig. Empfohlen wird ein Mix aus Clippings, Reichweite, Tonalität, Share of Voice und Web-Traffic. Vor dem Anzeigenäquivalenzwert wird zu Recht gewarnt. Künstliche Intelligenz erscheint dabei vor allem als Werkzeug: für die Medienbeobachtung, für die Automatisierung der Auswertung, für die Themenplanung. Anbieter wie Cision oder Landau Media werden als Werkzeuge für die Medienbeobachtung genannt, und PR-Agenturen richten ihre Medienarbeit konsistent danach aus. Das ist alles richtig, und der Zeitgewinn durch solche Werkzeuge ist unstrittig.
Was in diesen Best Practices fehlt, ist die Verwertbarkeit. Earned Media, also redaktionelle Erwähnungen ohne Bezahlung, werden über Online-Medien, Fachtitel und LinkedIn gezählt, aber nicht daraufhin geprüft, ob sie erreichbar sind. Für PR-Profis ist das bequem, weil die Zahlen aus dem gewohnten Werkzeug kommen. Für die Steuerung einer Kampagne ist es zu wenig.
Unsere Position ergänzt die andere Richtung. Alle genannten Kennzahlen messen dasselbe Ereignis, nämlich die Veröffentlichung. Keine von ihnen misst, ob diese Veröffentlichung für ein KI-System erreichbar ist. Genau dort entsteht aber gerade ein zweiter Kanal, in dem Ihre Zielgruppe Kaufentscheidungen vorbereitet. Unsere Stichprobe zeigt die Lücke: Bei 15 von 32 Medien liegt zwischen dem Eintrag im Medienspiegel und der Verwendung in einer KI-Antwort eine gesperrte Tür.
Dazu kommt ein zweiter Befund, der die alten Zahlen zusätzlich unter Druck setzt. Das Forschungsteam der Universität Leipzig um Michelle Wloka und Ansgar Zerfaß führt in seinem jährlichen Radar für das Kommunikationsmanagement ein Phänomen an erster Stelle:
„Simulierte Kommunikation: Informationsabruf und Debatten im Netz, die verdeckt von der zunehmenden Vorherrschaft automatisierter Akteure und unzuverlässiger Systeme generativer KI beeinflusst werden.“
(„Simulated Communication: Information retrieval and debates online that are covertly influenced by the rising dominance of automated agents (bots) and unreliable GenAI systems.“, Wloka und Zerfaß, Communication Management Radar)
Übersetzt in den Alltag einer Pressestelle: Wenn ein wachsender Teil der Zugriffe von automatisierten Akteuren stammt, wird jede Kennziffer unschärfer, die auf Sichtkontakten beruht. Reichweite und Klicks gehören dazu. Kennzahlen, die auf einer wiederholbaren eigenen Messung beruhen, sind davon weniger betroffen. Das ist der Grund, warum die Erwähnungsrate in dieser Liste vor der Reichweite steht. Eine PR-Strategie, die gegenüber Stakeholdern qualitativ wie quantitativ Rechenschaft ablegen soll, benötigt beide Sichtweisen auf die eigene Marke.
Ein Einwand ist berechtigt: Die neuen Größen sind aufwendiger als ein Klick im Werkzeug des Anbieters. Das stimmt. Für zwanzig Fragen in vier Systemen sollte ein halber Tag im Quartal eingeplant werden. Verglichen mit dem Aufwand für eine einzige Pressemitteilung ist das wenig.
9. Fazit
Die klassischen Größen der Öffentlichkeitsarbeit bleiben nützlich. Clippings zeigen Präsenz, Tonalität zeigt Stimmung, der Share of Voice zeigt die Position im Wettbewerb. Sie beschreiben aber nur eine von zwei Bühnen. Auf der zweiten laufen inzwischen 39 Prozent der deutschen Online-Nutzenden ihre Informationssuche, und dort entscheidet nicht die Auflage, sondern die Abrufbarkeit.
Der Einstieg ist kleiner, als er klingt. Zwanzig Testfragen, vier Systeme, ein fester Termin im Quartal. Wer diese Zeitreihe zwei Quartale lang führt, hat mehr belastbare Aussagen über die eigene Sichtbarkeit als aus jedem Reichweiten-Diagramm. Das Ziel ist eine Auswertung, die die Frage der Geschäftsführung beantwortet, statt sie zu umgehen.
10. Anhang: Checkliste für die nächsten vier Wochen
- Zwanzig Testfragen festlegen, überwiegend Kategorie-Fragen ohne den eigenen Namen
- Jede Frage fünfmal in ChatGPT, Claude, Gemini und Perplexity stellen und die Nennungen zählen
- Bei jeder Antwort die aufgeführten Quellen notieren und den Anteil der eigenen Domain berechnen
- Die robots.txt der zehn wichtigsten Zielmedien aufrufen und auf gesperrte Abrufprogramme prüfen
- Zehn Kernaussagen über das eigene Unternehmen abfragen und jede Abweichung notieren
- Eine Herkunftsfrage im Anfrageformular ergänzen, mit höchstens drei groben Kategorien
- Den Anzeigenäquivalenzwert aus dem Standardbericht streichen oder seine Grenzen dort benennen
- Einen festen Quartalstermin für die Wiederholung eintragen, damit eine Zeitreihe entsteht
Die Punkte eins bis drei sind an einem Nachmittag erledigt. Punkt vier braucht eine halbe Stunde. Der Rest ist Abstimmung im Haus.
11. Häufige Fragen zur PR Erfolgsmessung mit KI
Erst messen, dann entscheiden
In einem Gespräch klären wir, was ChatGPT, Gemini und Perplexity heute über Ihr Unternehmen sagen, woher diese Antworten stammen und an welcher Stelle Sie nachlegen können. Reicht dafür eine einmalige Messung, sagen wir Ihnen auch das.
Dieser Beitrag gibt den Stand zum Zeitpunkt der Veröffentlichung wieder. Die eigene Stichprobe ist eine Momentaufnahme vom 30. August und nicht repräsentativ; geprüft wurde ausschließlich das öffentlich ausgelieferte Rohdokument ohne JavaScript, ein Merkmal kann also vorhanden sein, ohne im Quelltext zu erscheinen. Bibliothekskataloge, amtliche Verkündungsblätter und Parteiorgane wurden vor der Messung ausgeschlossen. Einzelne Medien werden nicht genannt, ausgewertet wurden ausschließlich Summen. Die Werte von AMEC, YouGov, der Academic Society for Management and Communication sowie von Zhao und Berman sind den verlinkten Quellen entnommen und können sich ändern.
