Crawler-Dokumentation

LohiSoftBot

LohiSoftBot ist der von LohiSoft s.r.o. betriebene Webcrawler. Diese Seite dokumentiert, was er tut, wie Sie ihn erkennen und wie Sie ihn von Ihrer Website fernhalten.

Zuletzt aktualisiert: 23. August 2026

Auf einen Blick

User-Agent
LohiSoftBot/1.0
Quell-IP-Adressen
79.139.58.98, 79.139.58.121
Crawl-Budget
Max. 20 Seiten pro Website
Crawler-Hostnamen
*.bot.lohisoft.com
Kontakt
message@lohisoft.com

Wer den Crawler betreibt

Betreiber:
LohiSoft s.r.o.

Wozu LohiSoftBot dient

LohiSoftBot/1.0 baut den eigenen Suchindex von LohiSoft auf.

Er sammelt keine Trainingsdaten für KI-Modelle und kopiert keine Inhalte zur Weiterveröffentlichung.

Was er speichert

Für jede Seite speichert der Crawler ausschließlich Folgendes:

  • Den Seitentitel
  • Die meta description
  • Die h1–h3-Überschriften
  • Die URL
  • Den Text der Links, die auf die Seite verweisen

Was er nicht speichert

Der Textinhalt der Seite wird nicht gespeichert.

Der Index weist den Weg, er liefert keine Antwort: Ein Suchergebnis verlinkt stets zurück auf die Originalseite.

Wie viele Anfragen er stellt

Höchstens 20 Seiten pro Website.

Crawling-Etikette

  • Er hält sich an robots.txt gemäß RFC 9309.
  • Er sendet jeweils nur eine Anfrage pro Host, mit einer Verzögerung zwischen den Anfragen.
  • Bei HTTP-429- und 5xx-Antworten reduziert er die Anfragerate und beachtet dabei den Retry-After-Header.
  • Er umgeht niemals Logins, Paywalls oder Bot-Schutzmaßnahmen.

Wie man ihn blockiert

Fügen Sie Folgendes zu Ihrer robots.txt hinzu:

User-agent: LohiSoftBot
Disallow: /

Sie können den sofortigen Ausschluss auch per E-Mail an message@lohisoft.com beantragen. Wir entfernen die Domain daraufhin von der Crawl-Liste.

message@lohisoft.com

Den Crawler identifizieren und verifizieren

User-Agent-String

Aktuell verwendet
LohiSoftBot/1.0 (+message@lohisoft.com)
Wird eingeführt
LohiSoftBot/1.0 (+https://lohisoft.com/bot)

Die ältere, E-Mail-basierte Form wird schrittweise durch die URL-Form ersetzt. Beide sind legitim, sodass während der Übergangsphase beide Formen auftreten können.

Quell-IP-Adressen

Der Crawler ruft Seiten ausschließlich von diesen festen IPv4-Adressen ab:

  • 79.139.58.98
  • 79.139.58.121

Er stellt keine Anfragen über IPv6.

Maschinenlesbare Liste für Firewall- und WAF-Regeln:

https://lohisoft.com/bot/ips.json

Bereitgestellt als application/json über HTTPS, ohne Authentifizierung oder Weiterleitungen.

Forward-confirmed reverse DNS (FCrDNS)

Dies ist die empfohlene Methode zur Verifizierung des Crawlers. Sie ist unabhängig von der obigen IP-Liste und bleibt daher auch dann korrekt, wenn wir den Crawler auf eine andere Maschine verschieben.

  1. Führen Sie einen Reverse-Lookup für die IP-Adresse durch, von der die Anfrage stammt. Der zurückgegebene Hostname muss auf .bot.lohisoft.com enden.
  2. Führen Sie einen Forward-Lookup für diesen Hostnamen durch. Er muss wieder genau auf dieselbe IP-Adresse auflösen.
  3. Wenn einer der beiden Schritte nicht übereinstimmt, stammt die Anfrage nicht von uns, und Sie dürfen sie zu Recht blockieren.

Prüfen Sie auf die Endung .bot.lohisoft.com, nicht auf das bloße .lohisoft.com: Die bloße Domain deckt auch unseren Webserver und unseren Mailserver ab, während .bot.lohisoft.com ausschließlich die Crawler abdeckt.

Crawler-Hostnamen

79.139.58.98
crawler1.bot.lohisoft.com
79.139.58.121
crawler2.bot.lohisoft.com

Beispiel

$ dig +short -x 79.139.58.98
crawler1.bot.lohisoft.com.

$ dig +short crawler1.bot.lohisoft.com
79.139.58.98

Fragen?

Wenn hier etwas unklar ist oder Sie möchten, dass Ihre Domain vom Crawling ausgeschlossen wird, schreiben Sie uns.

LohiSoft s.r.o.

message@lohisoft.com