Textlager
Definition
Den maskinläsbara texten som lagras i ett dokument tillsammans med dess visuella utseende. Det är det som gör sökning och textmarkering möjliga, och det är exakt det en skannad sida saknar.
En född-digital PDF innehåller både en teckning av varje glyf och en registrering av vilket tecken den glyfen representerar. Sökning fungerar eftersom den andra saken finns. En skannad sida innehåller bara bilden — visuellt identisk, funktionellt inaktiv.
Detta är den vanligaste källan till förvirring i dokumentssökprojekt. "Sökning fungerar inte på dessa filer" betyder nästan alltid "dessa filer har skannats", och ingen mängd finjustering av sökmotorn förändrar det. Lösningen är OCR, vilket är en annan och avsevärt dyrare operation.
Office-format är det enkla fallet: en DOCX eller en XLSX är strukturerad text per definition, så textlagret är aldrig i fråga.
I Doconut
Fulltextsökning körs mot textlagret och tillhandahålls av det betalda AdvancedSearch‑pluginet. Om ett dokument saknar textlager renderas det korrekt men ger inga sökträffar.