# Enaio Dokumente ohne Volltext Index - Identifizierung möglich?

**URL:** <https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752>\
**Category:** enaio®\
**Created:** [11. September 2025 um 15:07 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752 "2025-09-11T15:07:07Z")\
**Posts on this page:** 7\
**Page:** 1

<div class="post-metadata">

**Author:** ![fb](https://ecm.community/user_avatar/ecm.community/fb/32/209_2.png) [@fb](https://ecm.community/u/fb)\
**Post date:** [11. September 2025 um 15:07 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752/1 "2025-09-11T15:07:07Z")

</div>

Hallo zusammen,

wir haben verstärkt das Thema, das vereinzelt (gerne auch mal gehäuft) enaio Dokumente die vom Volltext/OCR verarbeitet werden sollen dies nicht tun 🙂

Um unseren Nutzer zuvor zu kommen, die einen solchen Fehler feststellen und uns mit einem Ticket beglücken, träume ich von einer Möglichkeit jene Dokumente ohne Volltext-Index identifizieren zu können.

Bleibt es bei einem Traum oder habt Ihr eine Idee wie ich zumindest an die ID’s herankommen kann?

Merci vorab und viele Grüße  
Flo

---

<div class="post-metadata">

**Author:** ![rk](https://ecm.community/user_avatar/ecm.community/rk/32/679_2.png) [@rk](https://ecm.community/u/rk)\
**Post date:** [11. September 2025 um 15:53 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752/2 "2025-09-11T15:53:50Z")

</div>

Hoi @fb, meinst Du etwas in Richtung [enaio® index-manager](https://help.optimal-systems.com/enaio/v1110/admin/PDF/enaio_index-manager.pdf)?

> **Volltextübersicht**  
> Die Aktion zeigt eine Übersicht über die Objekttypen und das enaio®-System an.
> 
> […]
> 
> **Nachindizieren / PostIndexing**  
> Die Aktion überprüft Volltextdokumente, deren Indexdaten indiziert sind, deren Dateien aber auf Grund von Fehlern in der Kooperation mit der Rendition nicht indiziert werden konnten.

---

<div class="post-metadata">

**Author:** ![fb](https://ecm.community/user_avatar/ecm.community/fb/32/209_2.png) [@fb](https://ecm.community/u/fb)\
**Post date:** [17. September 2025 um 06:44 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752/3 "2025-09-17T06:44:23Z")

</div>

Hi @rk ,

ja genau. Dieses Tool arbeitet aber autark und führt alle Arbeiten automatisiert durch.  
Ich suche nach einer Möglichkeit an die ID’s der Objekte heranzukommen zu denen kein Volltext existiert um diese z.B. nach “meiner” Priorität dem Tool als ID-Liste (List-Indexing) zuzuführen.

_Hilft mir hier die OSFTSLOG Tabelle irgendwie weiter?_

Ich habe auch gerade die Herausforderung das die Warteschlange (OSRENDITIONCACHE) extrem lang ist. Da würden sich neue Aufträge ja am Ende einreihen.

_Kann ich diese irgendwie beeinflussen?_ 😆

LG Flo

---

<div class="post-metadata">

**Author:** ![uw](https://ecm.community/user_avatar/ecm.community/uw/32/695_2.png) [@uw](https://ecm.community/u/uw)\
**Post date:** [22. September 2025 um 12:55 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752/4 "2025-09-22T12:55:29Z")

</div>

Hallo @fb,

das sind zwei relativ komplizierte Themen 🙂

# ElasticSearch

Ab hier folgt mein ElasticSearch Halbwissen:

Allgemeine Infromationen zum Index findet sich hier über die URL [http://localhost:8041/\_stats](http://localhost:8041/_stats) abfragen. Das Login dazu findet man in der application-es.yml im Service-Manager.

Der Index für die Dateien heisst bei enaio üblicherweise `enaioblue_0`.  
Mit dem Endpunkt [http://localhost:8041/enaioblue\_0/\_stats](http://localhost:8041/enaioblue_0/_stats) kann man dann nochmals die Details zu diesem Index erfragen.

Den Dokumentenstatus kann man dann per [http://localhost:8041/enaioblue\_0/\_doc/2691?\_source=false](http://localhost:8041/enaioblue_0/_doc/2691?_source=false) erfragen, wobei dir 2691 die OS ID des Dokuments ist.

```json
{
  "_index": "enaioblue_0",
  "_type": "_doc",
  "_id": "2691",
  "_version": 2,
  "_seq_no": 74,
  "_primary_term": 93,
  "found": true
}

```

Wenn man das ?source=false weglässt, sieht man auch die indizierten Metadaten.

Details zu ElasticSearch API findet man zum Beispiel hier:

> **[Get a document by its ID | Elasticsearch API documentation](https://www.elastic.co/docs/api/doc/elasticsearch/operation/operation-get)**
>
> Get a document and its source or stored fields from an index.
> By default, this API is realtime and is not affected by the refresh rate of the index (when data will become visibl...

# DocumentViewer - RenditionCache

Dass die Queue an sich auf Dauer so voll ist, ist prinzipiell nicht so gut. Ist bekannt, warum dies so ist? Falls es sich hierbei um Fehler handelt, müsste man überlegen, ob man die Queue leer und schrittweise die Rendition auf den aktuellen Stand bringt.

Liebe Grüsse  
Uli

---

<div class="post-metadata">

**Author:** ![AlexanderKohrt](https://ecm.community/user_avatar/ecm.community/alexanderkohrt/32/464_2.png) [@AlexanderKohrt](https://ecm.community/u/AlexanderKohrt)\
**Post date:** [22. September 2025 um 13:29 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752/5 "2025-09-22T13:29:53Z")

</div>

Moin @fb , Gemäß der Doku kann man über die Flags in der osfts Tabelle ermitteln, ob der Volltext (Dokument und/oder Indexdaten) erstellt wurde:

> **[Wie kann man den Volltext beim Update migrieren? Welche Szenarien gibt es zum...](https://enaiodevelop.atlassian.net/wiki/spaces/PS/pages/21426437/Wie+kann+man+den+Volltext+beim+Update+migrieren+Welche+Szenarien+gibt+es+zum+Vervollst+ndigen+mit+Updatematrix)**

Vielleicht hilft das zusammen mit Ulis Antwort.

Gruß

Alexander

---

<div class="post-metadata">

**Author:** ![rk](https://ecm.community/user_avatar/ecm.community/rk/32/679_2.png) [@rk](https://ecm.community/u/rk)\
**Post date:** [9. Oktober 2025 um 05:50 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752/6 "2025-10-09T05:50:02Z")

</div>

Von einem Kollegen aus einem Projekt kommt noch folgender Hinweis. Diesen finde ich auch wichtig, da er komplett per API zu machen ist:

> 1. Ermitteln der Dokument-IDs und deren Typen z.B. des gestrigen Tages per SQL-Select
> 2. Prüfen pro Objekt-Typ, ob für dieses überhaupt ein Volltext aktiv ist
> 3. Check des Volltext-Ergebnisses pro Dokument per [http://localhost:8070/osrenditioncache/app/trusted/document//rendition/txt](http://localhost:8070/osrenditioncache/app/trusted/document/%3cOSID%3e/rendition/txt)
> 1. wenn hier etwas Sinnvolles im Return zurückgegeben wird, kann man von erfolgreicher OCR/Volltext für den Dokumenteninhalt ausgehen
> 2. falls nicht, kann man dafür die erneute Indexierung anstoßen

---

<div class="post-metadata">

**Author:** ![fb](https://ecm.community/user_avatar/ecm.community/fb/32/209_2.png) [@fb](https://ecm.community/u/fb)\
**Post date:** [10. Dezember 2025 um 08:12 UTC](https://ecm.community/t/enaio-dokumente-ohne-volltext-index-identifizierung-moeglich/752/7 "2025-12-10T08:12:41Z")

</div>

Hallo Ihr Lieben,

mega … vielen Dank für Eure Rückmeldungen 🙂

Viele Grüße  
Flo
