Hallo Leute,
ich möchte mir gerne den Crawler zum indizieren meiner Typo3-Site installieren. Leider ist die Installationsanleitung für mich komplett unverständlich, das angegebene Beispiel nicht vernünftig dokumentiert.
Ich hätte gerne, dass der Crawler meine ganze Site inkl. PDF-Files indiziert und diese dann über die Suche gefunden werden können. Gibt es dazu ein verständliches oder sogar schon vorgefertigtes TypoScript?
Bzw. was kann ich tun, dass der "normale" Index auch meine PDF Files indiziert? Die Tools die dafür notwendig sind, sind auf /usr/bin vorhanden, aber trotzdem werden diese nicht gefunden?
Danke,
Wolfgang
Von welchem "Crawler" reden wir denn hier? Google Desktop? Copernikus? indexed_search?
Ich meine den SiteCrawler (crawler in der repository) ...
Grüße,
Wolfgang
im vorletzten podcast gehts eigentlich nur um diese Extension, vielleihct hilft das weiter
lg georg
ps: thread verschoben
Ähm, sorry, in welchem vorletzten Podcast? Wo kann ich hier mehr dazu lesen?
Danke,
Wolfgang
Naja, mit dem kann ich nicht wirklich was anfangen, ich hätte lieber eine ordentliche Beschreibung oder ein Beispiel in Textform, an dem ich nachvollziehen kann, wie das Ding konfiguriert gehört und keinen Podcast!
Gibts denn nirgendwo eine ordentliche Beschreibung zu dem Crawler?
Grüße,
Wolfgang
Auf http://typo3.org/documentation/document-library/extension-manuals/ wäre die Extension auch gelistet... hätt gedacht das hättest du getan... man soll nie was annehmen
lg georg
Hallo Georg,
diese "Dokumentation" kenne ich, allerdings kann ich aus ihr nichts herauslesen. Das angeführte TypoScript ist von der Syntax her nicht erklärt und für mich nicht geeignet. Ich brauche weder andere Sprachen, noch die Mininews indiziert. Ich möchte gerne, dass der Crawler meine ganz normale Site ohne Sprachextras plus deren PDF-Files scannt.
Wenn ich allerdings keine TypoScript-Konfiguration durchführe scannt er auch schon mal nichts, bin etwas ratlos...
Grüße,
Wolfgang
Sofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?
Die "indexed_search" KANN sich der "crawler" Extension bedienen. Aber wenn ich das richtig sehe, dann kann indexed_search auch ohne crawler PDF-Dateien durchsuchen. Dazu muß (glaube ich) das Programm "catdoc" auf dem Server installiert sein.
laptop24 schrieb
Sofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?
Hallo!
Ja, ich dachte das eigentlich auch, dass die indexed_search das macht, da es ja dort die ganzen Programmpfade zu den PDF-Tools, etc. gibt. Die Tools sind auch installiert, nur werden die PDFs aus irgendeinem Grund nicht indiziert.
Was könnte der Grund sein, warum er die PDFs nicht einliest, bzw. welche Vorraussetzungen müssen erfüllt sein, dass der "indexer" anspringt?
Ich habe die PDFs sowohl von einer normalen "Typo-3"-Text-Seite verlinkt als auch von einer Typo3-HTML-Seite. Indiziert wird leider nichts. 😢
Grüße,
Wolfgang