Stand 6. September 2026 · Autorin Marion Sanchez-Schmalz
Vier Runden – weil eine englische Suche allein systematisch übersieht
Die meisten KI-gestützten Recherchen bestehen aus einer Runde: englische Stichwörter, erste Trefferseite, fertig. Das findet die global sichtbaren Spieler und übersieht zuverlässig die anderen. Deshalb läuft jede Discovery in vier Runden, und jeder Datensatz trägt den Vermerk, aus welcher Runde er stammt.
- ROUND_01
Englische Stichwortsuche
Technologie, Anwendung, Branche, Geografie in strukturierten Kombinationen. Findet die Unternehmen mit englischer Webpräsenz – also die, die sowieso jeder findet.
- ROUND_02
Regionale Lückenfüllung in Landessprache
Für jede unterrepräsentierte Region andere Quellen: Verbandsmitgliederlisten, Fördernehmerlisten staatlicher Programme, Messeausstellerverzeichnisse, Firmennamen in Originalschrift neben der Transliteration. Für China, Japan, Korea und den DACH-Raum jeweils eigene Quellenarten. Das ist die Runde, die eine englische Suche nicht ersetzen kann.
- ROUND_03
Verbände, Messen, Patente
Wer ausstellt, verkauft aktiv. Wer Fördermittel erhält, ist aktiv. Wer Patente anmeldet, entwickelt. Diese Listen sind oft vollständiger als jede Suchmaschine.
- ROUND_04
Referenzkunden der Wettbewerber
Fallstudien, Installationsmeldungen, Konferenzvorträge. Wer bereits ein vergleichbares Produkt gekauft hat, ist ein belegter Käufer dieser Produktklasse.
Weil jeder Datensatz seine Herkunft trägt, ist die Abdeckung am Ende eine Messung, keine Behauptung. Der Bericht sagt nicht „wir haben gründlich gesucht“, sondern: so viel Prozent kamen aus englischer Suche, so viel aus regionaler Lückenfüllung, so viel aus Verbandslisten – und hier sind die Regionen, in denen die Abdeckung dünn bleibt.
Zehn Regeln, die in jedem Scan gelten
Diese Regeln sind in die Methodik eingebaut, nicht nachträglich angewandt. Sie sind der Grund, warum das Ergebnis prüfbar ist.
- 01
Keine Aussage ohne Quelle
Jede Behauptung über einen Account trägt eine Quelle. Was keine hat, heißt UNVERIFIED – sichtbar, nie stillschweigend ergänzt.
- 02
Evidenzstufen T1–T9
Eine Pressemitteilung des Unternehmens (T1) wiegt anders als eine Stellenanzeige (T6) oder eine Ableitung aus der Konzernmutter (T9). Jede Quelle trägt ihre Stufe.
- 03
Aktualität
Jede Quelle trägt ein Datum und ein Flag: CURRENT (jünger als 12 Monate), AGING (12–24), STALE (älter als 24). Veraltete Belege werden nicht gelöscht, aber sie tragen weniger.
- 04
Konfidenz A / B / C
Wird aus Evidenzstufe und Aktualität berechnet, nicht vergeben. Sagt, wie belastbar eine Einstufung ist – und ändert die Einstufung selbst nie. Ein Tier-A-Account mit Konfidenz C ist genau das: gut passend, dünn belegt.
- 05
Mechanisches Tiering
Das Fit-Tier folgt aus den Kriterien nach festen Regeln. Zwei Analysten mit denselben Belegen kommen zum selben Tier.
- 06
Abdeckung wird gemessen
Jeder Datensatz trägt seine Herkunft (Runde und Quellentyp). Die Abdeckungsaussage im Bericht ist daraus berechnet.
- 07
Geschlossene Welt
Der Bericht enthält nur, was recherchiert wurde. Was offen bleibt, steht als „ungelöste Lücke“ im Bericht – nicht als Vermutung im Fließtext.
- 08
Erst finden, dann prüfen
Discovery und Verifikation sind getrennte Phasen. Nichts wird beim Finden schon bewertet, nichts beim Prüfen noch dazugesucht.
- 09
Annahmen mit ID
Jede Annahme hat eine Kennung (A-xx), eine Begründung, eine Konfidenz und eine Wirkung. Sie steht im Register, und jede Zahl, die an ihr hängt, verweist darauf.
- 10
Abgleich vor Auslieferung
Ein Skript prüft, dass Bericht, Modell und Datenbank dieselben Zahlen tragen. Schlägt eine Prüfung fehl, wird nicht geliefert.
Für Personen gilt zusätzlich: nur öffentliche Berufsdaten, keine Login-Recherche, Quelle und Abrufdatum je Datensatz, und vor der Übergabe eine Prüfung, ob die Person die Rolle noch innehat.
