OCR, Stempel- & Spracherkennung für die Sicherheit

Text in Bildern, Stempel auf gescannten Dokumenten und Sprache in aufgezeichneten Anrufen erkennen – alles on-premise.

Demo vereinbaren
Anexet Administrator Console mit Konfiguration der Erkennungsfunktionen

Der blinde Fleck jedes DLP-Systems – geschlossen

Bilder und Audioaufnahmen tragen dieselben vertraulichen Inhalte wie einfacher Text – nur lesen kann sie kaum ein DLP-System, bevor OCR und Spracherkennung sie in durchsuchbaren Text umwandeln.

Jede DLP-Bereitstellung hat einen blinden Fleck: Daten, die als Bild ankommen. Ein Vertrag, als JPEG gescannt, ein Screenshot einer vertraulichen Tabelle, ein abgestempeltes Freigabedokument, mit dem Smartphone fotografiert – all das ist per Schlüsselwortsuche unlesbar, solange das Bild nicht in Text umgewandelt wurde. Dieselbe Lücke besteht bei Audio: Ein vom Monitoring-Modul aufgezeichneter Anruf trägt keinen durchsuchbaren Inhalt, bevor ihn jemand transkribiert.

Genau diese Lücken schließen die Erkennungsfunktionen von Anexet. Das Modul Image Recognition – konfiguriert in der Administrator Console – liest gedruckten und handschriftlichen Text aus erfassten Bildern und erkennt, ob ein Firmenstempel oder Siegel auf einem Dokument vorkommt. Die Speech Recognition ergänzt das Bild: Sie transkribiert erfasste Audioaufnahmen in durchsuchbaren Text, mit Sprechererkennung zur Zuordnung einer Stimme zu einem bekannten Profil. Anexet identifiziert zudem Personen anhand des Gesichts in erfassten Bildern – wie das funktioniert, zeigt die eigene Seite zur Gesichtserkennung.

Dieses Funktionspaket ist relevant für Sicherheitsteams bei internen Untersuchungen, für Compliance-Beauftragte, die prüfen müssen, ob abgestempelte Freigabeprozesse eingehalten wurden, und für IT-Sicherheitsverantwortliche, die sicherstellen müssen, dass vertrauliche Dokumente das Unternehmen unabhängig vom Format nicht verlassen.

Warum das wichtig ist

  • Bilder werden durchsuchbar

    OCR wandelt erfasste Scans, Screenshots und Fotos in maschinenlesbaren Text um – sichtbar für Schlüsselwortrichtlinien, Thesaurus-Regeln und digitale Fingerabdrücke.

  • Stempelfälschungen sind erkennbar

    Eine konfigurierte Stempelbank lässt das System Dokumente mit unbekannten, fehlenden oder gefälschten Firmensiegeln markieren, bevor sie das Unternehmen verlassen.

  • Audio ist so durchsuchbar wie Text

    Die Spracherkennung transkribiert aufgezeichnete Anrufe und VoIP-Sitzungen; die Sprechererkennung ordnet die Stimme für Untersuchungen einem bekannten Profil zu.

Erkennungsfunktionen im Überblick

Sie werden in der Administrator Console konfiguriert und arbeiten mit Information Search, Security Policies und Investigations zusammen.

Bildanalyse

  • OCR – Text in Bildern und Scans

    Premium

    Erkennt gedruckten und handschriftlichen Text auf erfassten Bildern, Screenshots und gescannten Dokumenten. Der extrahierte Text wird über Information Search und Complex Search durchsuchbar – Schlüsselwortsuchen, Thesaurus-Regeln, digitale Fingerabdrücke und Hash-Vergleiche greifen gleichermaßen.

  • Stempel- und Siegelerkennung

    Premium

    Erkennt, ob ein Firmenstempel oder ein offizielles Siegel auf einem Dokumentenbild vorkommt. Administratoren pflegen eine Stempelbank mit Referenzmustern; das System markiert erfasste Dokumente, deren Stempel mit Einträgen der Bank übereinstimmen oder davon abweichen.

  • Gesichtserkennung

    Premium

    Identifiziert Personen in erfassten Bildern durch Abgleich erkannter Gesichter mit einer Referenzbibliothek. Vollständig beschrieben, inklusive Einrichtung und Einsatz bei Untersuchungen, auf der eigenen Seite zur Gesichtserkennung.

Audioanalyse

  • Sprache-zu-Text (Speech Recognition)

    Premium

    Transkribiert erfasste Audioaufnahmen – Anrufe aus dem Modul Audio/Video Monitoring, VoIP-/SIP-Sitzungen und aufgezeichnetes Mikrofon-Audio – in durchsuchbaren Text, der in der Client Console zusammen mit der Originaldatei gespeichert wird.

  • Sprechererkennung

    Premium

    Ordnet die Stimme in einer Aufnahme einem bekannten Sprachprofil zu und erlaubt Untersuchungen, gesprochene Inhalte einer bestimmten Person zuzuordnen.

Die Erkennung läuft vollständig on-premise innerhalb Ihrer eigenen Infrastruktur. Weder Bilder noch Audiodateien noch erkannte Inhalte verlassen Ihren Perimeter.

On-Premise-Erkennung – kein Zugriff des Anbieters

Erfasste Bilder und Audioaufnahmen gehen an die Erkennungs-Engine, die innerhalb der Infrastruktur Ihres Unternehmens läuft. OCR extrahiert Text Zeichen für Zeichen; die Stempelerkennung vergleicht Dokumentenbilder mit der administratorseitig konfigurierten Stempelbank; die Spracherkennung transkribiert Audio in Text. Alle extrahierten Inhalte werden zusammen mit dem ursprünglichen Erfassungsdatensatz indexiert – der angereicherte Datensatz enthält sowohl das Rohbild oder die Audiodatei als auch den erkannten Text, mit Nutzer, Arbeitsstation, Zeitstempel und Kanal als Metadaten.

Anexet wird on-premise betrieben; der Anbieter hat keinen Zugriff auf Ihre Daten. Die gesamte Erkennung – OCR, Stempelabgleich und Sprachtranskription – findet innerhalb der Infrastruktur Ihres Unternehmens statt. Keine erfassten Inhalte, Bilder, Audiodateien oder erkannten Daten verlassen Ihren Perimeter.

Erfasstes Dokument mit OCR-extrahiertem Text in der Anexet Client Console
Erkennungsergebnisse und Nutzeraktivität in der Anexet Client Console

So funktioniert Content Recognition

Vier Schritte vom erfassten Bild oder der Audiodatei bis zum durchsuchbaren, richtlinienfähigen Datensatz.

Agenten auf überwachten Endgeräten erfassen Bilder über alle Kanäle – Messenger-Anhänge, E-Mail, Cloud-Uploads, USB-Übertragungen, Screenshots – und zeichnen Audio über das Modul Audio/Video Monitoring auf.

1

Erfasste Bilder und Audioaufnahmen gehen an die On-Premise-Erkennungs-Engine: OCR extrahiert Text, die Stempel-Engine vergleicht mit der Stempelbank, die Spracherkennung transkribiert Audio.

2

Extrahierter Text und Erkennungstreffer werden zusammen mit dem ursprünglichen Erfassungsdatensatz indexiert und um Nutzer, Arbeitsstation, Zeitstempel, Kanal sowie abgeglichene Stempel angereichert.

3

Sicherheitsbeauftragte durchsuchen erkannte Inhalte in der Client Console über Information Search und Complex Search; Security Policies können Alarme auslösen, wenn erkannter Inhalt einer Regel entspricht – etwa ein abgestempeltes Dokument an einen nicht autorisierten Empfänger oder ein transkribierter Anruf mit untersagten Formulierungen.

4

Agenten auf überwachten Endgeräten erfassen Bilder über alle Kanäle – Messenger-Anhänge, E-Mail, Cloud-Uploads, USB-Übertragungen, Screenshots – und zeichnen Audio über das Modul Audio/Video Monitoring auf.

1

Erfasste Bilder und Audioaufnahmen gehen an die On-Premise-Erkennungs-Engine: OCR extrahiert Text, die Stempel-Engine vergleicht mit der Stempelbank, die Spracherkennung transkribiert Audio.

2

Extrahierter Text und Erkennungstreffer werden zusammen mit dem ursprünglichen Erfassungsdatensatz indexiert und um Nutzer, Arbeitsstation, Zeitstempel, Kanal sowie abgeglichene Stempel angereichert.

3

Sicherheitsbeauftragte durchsuchen erkannte Inhalte in der Client Console über Information Search und Complex Search; Security Policies können Alarme auslösen, wenn erkannter Inhalt einer Regel entspricht – etwa ein abgestempeltes Dokument an einen nicht autorisierten Empfänger oder ein transkribierter Anruf mit untersagten Formulierungen.

4

Arrow

Erkennung nach Plan

StandardGrundlegende Überwachung der Mitarbeiteraktivität.
Erfassung des Netzwerkverkehrs
USB-Kontrolle
Drucküberwachung
Erfassung von Messengern
Erfassung von Browsern
und 4 weitere
Am beliebtesten
AdvancedErgänzt DLP und mehr Tiefe in der Analyse.
Plan Standard enthalten
DLP-Funktionen
Überwachung von Netzlaufwerken
Keylogger
Webcam-Bilder
und 4 weitere
Alles in einem
PremiumDie All-in-one-Lösung.
Pläne Standard + Advanced enthalten
Erweiterte Suche (digitale Fingerabdrücke, Hash-Suche)
Überwachung von Dateisystemen
Analyse von Nutzerbeziehungen
Risikoanalyse
und 6 weitere

Häufig gestellte Fragen

Häufige Fragen zu OCR, Stempelerkennung und Sprache-zu-Text bei Anexet.

Was bedeutet OCR-Erkennung im DLP-Kontext?

Im DLP-Kontext bedeutet OCR (optische Zeichenerkennung), dass erfasste Bilder und gescannte Dokumente automatisch in maschinenlesbaren Text umgewandelt werden. Dieser Text ist danach durchsuchbar, lässt sich mit Schlüsselwortregeln und Thesauren abgleichen und kann Alarme aus Security Policies auslösen – genau wie jeder andere erfasste Text. Ohne OCR bleibt das Bild eines vertraulichen Vertrags für inhaltsbasierte Richtlinien unsichtbar.

Eine Stempelbank ist eine Bibliothek von Referenzbildern für Firmenstempel und offizielle Siegel, konfiguriert vom Administrator in der Administrator Console. Verarbeitet die Erkennungs-Engine ein erfasstes Dokumentenbild, gleicht sie erkannte Stempel mit der Bank ab. Ein Treffer wird im Erfassungsdatensatz vermerkt und kann einen Alarm aus Security Policies auslösen. Das hilft, gefälschte Stempel zu erkennen oder zu bestätigen, dass ausgehende Dokumente die richtigen Freigaben tragen.

Ja – die Gesichtserkennung wertet Standbilder aus, die über überwachte Kanäle erfasst wurden, und gleicht erkannte Gesichter mit einer Referenzbibliothek ab. Sie ist eine eigenständige Funktion neben OCR und Spracherkennung und wird vollständig auf der eigenen Seite zur Gesichtserkennung beschrieben, inklusive Konfiguration und Einsatz bei Untersuchungen.

Alle Erkennungsfunktionen – OCR, Stempel- und Siegelerkennung, Gesichtserkennung, Sprache-zu-Text und Sprechererkennung – sind ausschließlich im Premium-Plan enthalten. Standard und Advanced enthalten sie nicht.

Anexet wird on-premise betrieben; der Anbieter hat keinen Zugriff auf Ihre Daten. Die gesamte Erkennung – OCR, Stempelabgleich und Sprachtranskription – findet innerhalb der Infrastruktur Ihres Unternehmens statt. Keine erfassten Inhalte, Bilder, Audiodateien oder erkannten Daten verlassen Ihren Perimeter.

Speech Recognition verarbeitet Audio, das über das Modul Audio/Video Monitoring von Anexet erfasst wird: Mikrofonaufnahmen, Lautsprecheraufnahmen und VoIP-/SIP-Anrufaufzeichnungen. Es transkribiert das Audio in Text, der zusammen mit der Originaldatei als durchsuchbarer Datensatz gespeichert wird. Die Sprechererkennung ordnet erkannte Sprache einem bestimmten Sprachprofil zu.

Drei Fachleute besprechen sich in einem Meeting und schauen auf ein Tablet

Content Recognition in Aktion sehen

Sagen Sie uns, welche Dokumenttypen und Audiokanäle Sie abdecken müssen – wir zeigen Ihnen in einer kostenlosen Demo oder einer vollständigen Testversion von Anexet Ultimate, wie OCR, Stempelerkennung und Sprache-zu-Text in Ihrer Umgebung funktionieren.

Ich stimme zu, dass meine personenbezogenen Daten gemäß der Datenschutzerklärung verarbeitet werden