Von welchem "Crawler" reden wir denn hier? Google Desktop? Copernikus? indexed_search?
Crawler-Konfiguration
Ich meine den SiteCrawler (crawler in der repository) ...
Grüße,
Wolfgang
im vorletzten podcast gehts eigentlich nur um diese Extension, vielleihct hilft das weiter
lg georg
ps: thread verschoben
Ähm, sorry, in welchem vorletzten Podcast? Wo kann ich hier mehr dazu lesen?
Danke,
Wolfgang
Naja, mit dem kann ich nicht wirklich was anfangen, ich hätte lieber eine ordentliche Beschreibung oder ein Beispiel in Textform, an dem ich nachvollziehen kann, wie das Ding konfiguriert gehört und keinen Podcast!
Gibts denn nirgendwo eine ordentliche Beschreibung zu dem Crawler?
Grüße,
Wolfgang
Auf http://typo3.org/documentation/document-library/extension-manuals/ wäre die Extension auch gelistet... hätt gedacht das hättest du getan... man soll nie was annehmen
lg georg
just2b schriebAuf http://typo3.org/documentation/document-library/extension-manuals/ wäre die Extension auch gelistet... hätt gedacht das hättest du getan... man soll nie was annehmen
Hallo Georg,
diese "Dokumentation" kenne ich, allerdings kann ich aus ihr nichts herauslesen. Das angeführte TypoScript ist von der Syntax her nicht erklärt und für mich nicht geeignet. Ich brauche weder andere Sprachen, noch die Mininews indiziert. Ich möchte gerne, dass der Crawler meine ganz normale Site ohne Sprachextras plus deren PDF-Files scannt.
Wenn ich allerdings keine TypoScript-Konfiguration durchführe scannt er auch schon mal nichts, bin etwas ratlos...
Grüße,
Wolfgang
Sofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?
Die "indexed_search" KANN sich der "crawler" Extension bedienen. Aber wenn ich das richtig sehe, dann kann indexed_search auch ohne crawler PDF-Dateien durchsuchen. Dazu muß (glaube ich) das Programm "catdoc" auf dem Server installiert sein.
laptop24 schriebSofern ich jetzt nicht irgendwo einen Knoten habe, dann erledigt das doch die normale "indexed_search" Extension. Wofür benötigst Du da die "crawler" Ext?
Hallo!
Ja, ich dachte das eigentlich auch, dass die indexed_search das macht, da es ja dort die ganzen Programmpfade zu den PDF-Tools, etc. gibt. Die Tools sind auch installiert, nur werden die PDFs aus irgendeinem Grund nicht indiziert.
Was könnte der Grund sein, warum er die PDFs nicht einliest, bzw. welche Vorraussetzungen müssen erfüllt sein, dass der "indexer" anspringt?
Ich habe die PDFs sowohl von einer normalen "Typo-3"-Text-Seite verlinkt als auch von einer Typo3-HTML-Seite. Indiziert wird leider nichts. 😢
Grüße,
Wolfgang