liegen dort über längere Zeit und sind unveränderbar -->"tote Dokumente" (revisionssicher)
DMS:
verwaltet "lebende" Dokumente, die noch ver- oder bearbeitet werden
achtet auf Versionierung der Dokumente
sorgt dafür, dass Dokumente nicht überschrieben werden
besitzt Check-In/ Check-Out-Prinzip
unterstützt Dokumentenlebenszyklus
Card 7
Question
Grundlegende Architektur eines DMS?
Answer
Kern des DMS --> zentrale DB
zentrale DB verbindet zahlreiche heterogene Quellen (z.B. Langzeitarchive, Storage-Systeme)
Anwender greift über dessen Client auf zentrale DB zu, die erlaubt, individuelle Strukturen anzulegen
zentrale DB ist kein Speicherort. Sie greift widerum auf Dokumente in deren Speicherort zu.
Card 8
Question
Abgrenzung DMS zu WCM?
Answer
WCM (= Web Content Management)
Dokument setzt sich aus Einzelteilen zsm
Zugriff erfolgt über Web-Browser
Integration in Web-Umgebung ermöglicht dies
DMS
Dokument = logische Einheit (Verwaltungseinheit), kann in versch. Formaten vorliegen
meist in betriebl. Umfeld integriert
Zugriff kann z.B. über ERP- oder Mail-Systeme erfolgen
Card 9
Question
Worin besteht der Nutzen, eine externe DB bei der Vergabe der Attributwerte mit einzubinden? + konkretes Beispiel
Answer
Attributierung unterstützt Recherche nach Dokumenten (effizienter und schneller)
falsche Verschlagwortung --> Dokument könnte nicht mehr gefunden werden
daher externe DBs, die auf bestehenden Wortschatz zurückgreifen, bzw. Nutzer Wörter zur Verschlagwortung vorschlagen, die bei Attributierung verwendet wurden
Bsp:
HR-Modul in einem ERP-System
Personalstammdaten sind eingebunden
Einbindung eines Thesaurus, welcher Attributierung mittels Synonymen erleichtert
Card 10
Question
Warum handelt es sich bei den beiden Größen zur Bewertung der Effektivität eines Recherche-Werkzeugs (Precision and Recall) um theoretische Werte und welchen Nutzen haben diese in der praktischen Umsetzung?
Answer
ermöglichen es, Relevanz vorhandener Daten in Bezug auf gefundene Daten innerhalb gegebener Datenbasis zu bewerten.
Precision (= Genauigkeit) --> Wahrscheinlichkeit, dass gefundenes Dokument relevant ist.
(relevant & gefunden) / gefunden
Recall (= Trefferquote) --> Wahrscheinlichkeit, dass relevantes Dokument gefunden wird
(relevant & gefunden) / relevant
Beide Größen sind voneinander abhängig. Erhöhrt sich die Trefferquote, so sinkt die Genauigkeit und vice versa.
Card 11
Question
Allgemeine Darstellung der Schritte der Verarbeitung (Erstellung, Erfassung, Erschließung,...)
Answer
Dokumentenerstellung
Dok. wird mit Textverarbeitungsprogramm (o.ä.) erstellt und ggf. in Papierform ausgedruckt
Dokumentenerfassung
Dok. wird digitalisiert
Unterscheidung
NCI (= Non Coded Information) Doks.
CI (= Coded Information) Doks.
Mischdokumente (z.B. Emails mit Anhang)
Digitalisierung erfolgt entweder per
manueller Erfassung
Scan (frühes vs. spätes Scannen)
Kamera
Dokumentenerschließung
Dok. wird in DB erfasst und mit zusätzl. Infos versehen, die Suche erleichtern (Attributierung, Verschlagwortung, Indizes)
Attributierung
manuell (fehleranfällig)
daher Verwendung externer DB (Vorschlag Liste gültiger Werte)
automatisiert
Formulare können auch mittels Optical oder Intelligent Character Recognition erschlossen werden.
Dokumentenrecherce
Unterscheidung
direkte Suche über Attribute und Indizes (schnellste Suche)
arbeitet auf Meta-Daten-Ebene
kann auch Volltextrecherche verwendet werden - durchsucht alle Doks. nach best. Wortfolge
Suche über Ordnerstruktur
Suche mittel Navigation (Links)
optimal ist Kombination aus 2 DBs
eine enthält Volltextindizes für Volltextrecherche
eine enthält andere Attributwerte für Metadatenrecherche
Card 12
Question
Erfassung (frühes vs. spätes Scannen)
Answer
Frühes Scannen
+
-
schnelle Verteilung elektr. Doks.
Anzahl unwichtiger Doks. im System
unmittelbare Ablage nach Eingang des Doks.
großer Umstellungsaufwand für Sacharbeiter
Spätes Scannen
+
-
geringer Umstellungsaufwand für Sacharbeiter
teils lange Wartezeiten aus Post
nur relevante Doks. werden ins System aufgenommen
Gefahr des Verlierens von Doks. vor Archivierung
späte Verfügbarkeit im System zur Bearbeitung
Card 13
Question
Erschließung (manuelle vs. automatische Attributierung)
Answer
Manuelle Attributierung
Automatische Attributierung
fehleranfällig (z.B. Vertippen)
kann erfolgen, wenn System Aufbau des Doks. kennt und sich benötigte Infos per OCR/ ICR aus dem Dokument extrahieren kann
besitzt keine Normierung (untersch. Wortschatz der Mitarbeiter)
wesentlich komplexere Technik
Maßnahmen zur Anbindung einer externen DB müssen ergriffen werden
Card 14
Question
Erschließung (Verfahren zur Qualitätssteigerung und manueller Attributierung)
Answer
Verwendung externer DB kann manuelle Attributierung verbessern. Nutzer kann dann nurnoch aus einer Liste gültiger Werte wählen, sodass Tippfehler ausgeschlossen werden können.
Card 15
Question
Erkläre die Erschließungsmthode (Thesaurus)
Answer
Bei einem Thesaurus handelt es sich um eine Schlagwortliste, die ein- oder mehrdimensional aufgebaut sein kann. Diese beinhaltet ein kontrolliertes Vokabular, dessen Begriffe durch Relationen miteinander verbunden sind.
Card 16
Question
Erkläre die Besonderheiten der Recherche-Methode COLD.
Answer
COLD (= Computer-Output on Laserdisk)
Verfahren, um Großrechnerausgaben (z.B. Rechnungen) mithilfe elektr. Archive dauerhaft archivieren
Besonderheiten ->
Spooldatei wird erzeugt, besteht i.d.R. aus Nutzdaten (Inhalt)
Layout des Doks. wird nur ein Mal gespeichert
Bei Ausgabe wird Layout mit Nutzdaten zsm-geführt
"Mischdokument" entsteht
Card 17
Question
Erkläre die Ablagestragien der Recherche-Methode COLD
Answer
COLD (= Computer-Output on Laserdisk)
Ablage kann auf zwei Arten erfolgen:
getrennt vom Layout (wie zuvor beschrieben)
zusammen mit dem Layout (benötigt mehr Speicherplatz)
Card 18
Question
Erläutere die Ablagegranularitäten der Recherche-Methode COLD
Answer
COLD (= Computer-Output on Laserdisk)
Unterscheidung zwischen:
alle Dokumente (z.B. Rechnungen) eines Tages zsm abzulegen
oder vorher zu trennen und z.B. den jeweiligen Kunden zuzuordnen
Card 19
Question
Wird die Gewährleistung der Integrität eines Dokuments dessen Veränderung ausgeschlossen?
Answer
Nein - es ist möglich, herauszufinden, ob eine Veränderung stattgefunden hat
Es ist jedoch nicht möglich, nachzuvollziehen, was geändert wurde.
Ansonsten wäre es möglich, aus dem Fingerabdruck des Dokuments, dieses zu rekonstruieren
Card 20
Question
Welche beiden grundlegenden Aspekte müssen bei einer Layoutierung immer angewandt werden und welche XML-Standards decken diese Aspekte jeweils ab?
Answer
Baum-Transformation
es ermöglicht einen XML-Quellbaum in einen Ergebnisbaum oder ggf. in eine andere Struktur umzuwandeln
danach kann XSLT (= Extensible Stylesheet Language Transformations) verwendet werden
XSLT ist eine XML-Sprache zur Transformation von XML-Strukturen in andere Repräsentationen
Sprache kann anderen Text oder Elemente erzeugen
XSLT zeichnet sich durch die Definition von Nummerierung, Wiederholungen (for each) und Bedingungen (if, choose) aus
Formatierung
Elemente des Ereignisbaums auf Papier, Displays, als Sprachausgabe oder in ähnlicher Form.
dazu kann XSL-LO oder XSL verwendet werden (Layout-Definitionen eines XML-Dokuments, bei dessen Ausgabe mittels entsprechender Objekte und deren Eigenschaften)
How to use this set
Read the preview and check whether the content and answers suit your learning goal. You can add the public set to your sets to study it. Your account shows the available actions.