Zum Inhalt springen

Crawler-Konfiguration

Erstellt am 6. Juni 2006 · 10 Antworten · letzte Antwort am 8. Juni 2006

Tags: Frage

wolfi3300 ·

Hallo Leute,

ich möchte mir gerne den Crawler zum indizieren meiner Typo3-Site installieren. Leider ist die Installationsanleitung für mich komplett unverständlich, das angegebene Beispiel nicht vernünftig dokumentiert.

Ich hätte gerne, dass der Crawler meine ganze Site inkl. PDF-Files indiziert und diese dann über die Suche gefunden werden können. Gibt es dazu ein verständliches oder sogar schon vorgefertigtes TypoScript?

Bzw. was kann ich tun, dass der "normale" Index auch meine PDF Files indiziert? Die Tools die dafür notwendig sind, sind auf /usr/bin vorhanden, aber trotzdem werden diese nicht gefunden?

Danke,
Wolfgang

just2b ·

im vorletzten podcast gehts eigentlich nur um diese Extension, vielleihct hilft das weiter

lg georg
ps: thread verschoben

wolfi3300 ·

Naja, mit dem kann ich nicht wirklich was anfangen, ich hätte lieber eine ordentliche Beschreibung oder ein Beispiel in Textform, an dem ich nachvollziehen kann, wie das Ding konfiguriert gehört und keinen Podcast!

Gibts denn nirgendwo eine ordentliche Beschreibung zu dem Crawler?

Grüße,
Wolfgang

wolfi3300 ·
just2b schrieb

Auf http://typo3.org/documentation/document-library/extension-manuals/ wäre die Extension auch gelistet... hätt gedacht das hättest du getan... man soll nie was annehmen

Hallo Georg,
diese "Dokumentation" kenne ich, allerdings kann ich aus ihr nichts herauslesen. Das angeführte TypoScript ist von der Syntax her nicht erklärt und für mich nicht geeignet. Ich brauche weder andere Sprachen, noch die Mininews indiziert. Ich möchte gerne, dass der Crawler meine ganz normale Site ohne Sprachextras plus deren PDF-Files scannt.

Wenn ich allerdings keine TypoScript-Konfiguration durchführe scannt er auch schon mal nichts, bin etwas ratlos...

Grüße,
Wolfgang

laptop24 ·

Sofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?

Die "indexed_search" KANN sich der "crawler" Extension bedienen. Aber wenn ich das richtig sehe, dann kann indexed_search auch ohne crawler PDF-Dateien durchsuchen. Dazu muß (glaube ich) das Programm "catdoc" auf dem Server installiert sein.

wolfi3300 ·
laptop24 schrieb

Sofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?

Hallo!

Ja, ich dachte das eigentlich auch, dass die indexed_search das macht, da es ja dort die ganzen Programmpfade zu den PDF-Tools, etc. gibt. Die Tools sind auch installiert, nur werden die PDFs aus irgendeinem Grund nicht indiziert.

Was könnte der Grund sein, warum er die PDFs nicht einliest, bzw. welche Vorraussetzungen müssen erfüllt sein, dass der "indexer" anspringt?

Ich habe die PDFs sowohl von einer normalen "Typo-3"-Text-Seite verlinkt als auch von einer Typo3-HTML-Seite. Indiziert wird leider nichts. 😢

Grüße,
Wolfgang