Zum Inhalt springen

Crawler-Konfiguration

Erstellt am 6. Juni 2006 · 10 Antworten · letzte Antwort am 8. Juni 2006

Tags: Frage

just2b ·

im vorletzten podcast gehts eigentlich nur um diese Extension, vielleihct hilft das weiter

lg georg
ps: thread verschoben

wolfi3300 ·

Naja, mit dem kann ich nicht wirklich was anfangen, ich hätte lieber eine ordentliche Beschreibung oder ein Beispiel in Textform, an dem ich nachvollziehen kann, wie das Ding konfiguriert gehört und keinen Podcast!

Gibts denn nirgendwo eine ordentliche Beschreibung zu dem Crawler?

Grüße,
Wolfgang

wolfi3300 ·
just2b schrieb

Auf http://typo3.org/documentation/document-library/extension-manuals/ wäre die Extension auch gelistet... hätt gedacht das hättest du getan... man soll nie was annehmen

Hallo Georg,
diese "Dokumentation" kenne ich, allerdings kann ich aus ihr nichts herauslesen. Das angeführte TypoScript ist von der Syntax her nicht erklärt und für mich nicht geeignet. Ich brauche weder andere Sprachen, noch die Mininews indiziert. Ich möchte gerne, dass der Crawler meine ganz normale Site ohne Sprachextras plus deren PDF-Files scannt.

Wenn ich allerdings keine TypoScript-Konfiguration durchführe scannt er auch schon mal nichts, bin etwas ratlos...

Grüße,
Wolfgang

laptop24 ·

Sofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?

Die "indexed_search" KANN sich der "crawler" Extension bedienen. Aber wenn ich das richtig sehe, dann kann indexed_search auch ohne crawler PDF-Dateien durchsuchen. Dazu muß (glaube ich) das Programm "catdoc" auf dem Server installiert sein.

wolfi3300 ·
laptop24 schrieb

Sofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?

Hallo!

Ja, ich dachte das eigentlich auch, dass die indexed_search das macht, da es ja dort die ganzen Programmpfade zu den PDF-Tools, etc. gibt. Die Tools sind auch installiert, nur werden die PDFs aus irgendeinem Grund nicht indiziert.

Was könnte der Grund sein, warum er die PDFs nicht einliest, bzw. welche Vorraussetzungen müssen erfüllt sein, dass der "indexer" anspringt?

Ich habe die PDFs sowohl von einer normalen "Typo-3"-Text-Seite verlinkt als auch von einer Typo3-HTML-Seite. Indiziert wird leider nichts. 😢

Grüße,
Wolfgang