Top-Themen

AppleEntwicklungHardwareInternetLinuxMicrosoftMultimediaNetzwerkeOff TopicSicherheitSonstige SystemeVirtualisierungWeiterbildungZusammenarbeit

Aktuelle Themen

Administrator.de FeedbackApache ServerAppleAssemblerAudioAusbildungAuslandBackupBasicBatch & ShellBenchmarksBibliotheken & ToolkitsBlogsCloud-DiensteClusterCMSCPU, RAM, MainboardsCSSC und C++DatenbankenDatenschutzDebianDigitiales FernsehenDNSDrucker und ScannerDSL, VDSLE-BooksE-BusinessE-MailEntwicklungErkennung und -AbwehrExchange ServerFestplatten, SSD, RaidFirewallFlatratesGoogle AndroidGrafikGrafikkarten & MonitoreGroupwareHardwareHosting & HousingHTMLHumor (lol)Hyper-VIconsIDE & EditorenInformationsdiensteInstallationInstant MessagingInternetInternet DomäneniOSISDN & AnaloganschlüsseiTunesJavaJavaScriptKiXtartKVMLAN, WAN, WirelessLinuxLinux DesktopLinux NetzwerkLinux ToolsLinux UserverwaltungLizenzierungMac OS XMicrosoftMicrosoft OfficeMikroTik RouterOSMonitoringMultimediaMultimedia & ZubehörNetzwerkeNetzwerkgrundlagenNetzwerkmanagementNetzwerkprotokolleNotebook & ZubehörNovell NetwareOff TopicOpenOffice, LibreOfficeOutlook & MailPapierkorbPascal und DelphiPeripheriegerätePerlPHPPythonRechtliche FragenRedHat, CentOS, FedoraRouter & RoutingSambaSAN, NAS, DASSchriftartenSchulung & TrainingSEOServerServer-HardwareSicherheitSicherheits-ToolsSicherheitsgrundlagenSolarisSonstige SystemeSoziale NetzwerkeSpeicherkartenStudentenjobs & PraktikumSuche ProjektpartnerSuseSwitche und HubsTipps & TricksTK-Netze & GeräteUbuntuUMTS, EDGE & GPRSUtilitiesVB for ApplicationsVerschlüsselung & ZertifikateVideo & StreamingViren und TrojanerVirtualisierungVisual StudioVmwareVoice over IPWebbrowserWebentwicklungWeiterbildungWindows 7Windows 8Windows 10Windows InstallationWindows MobileWindows NetzwerkWindows ServerWindows SystemdateienWindows ToolsWindows UpdateWindows UserverwaltungWindows VistaWindows XPXenserverXMLZusammenarbeit

Aufgabe für Anspruchsvolle! Dateiinhalt einer Email auslesen

Frage Entwicklung

Mitglied: Abdelhalim

Abdelhalim (Level 1) - Jetzt verbinden

22.02.2007, aktualisiert 14:00 Uhr, 6115 Aufrufe, 2 Kommentare, 1 Danke

Ich habe eine wirkliche Aufgabe für Anspruchsvolle! (Möglicherweise Lösbar)
Also wir erhalten im Unternehmen immer wieder Emails von einer Tochtergesellschaft. Diese Emails beinhalten gescannte Faxe im Anhang. Der Name dieser TIF-Dateien lautet meistens so: "pp000000", somit spiegeln sie nicht den Inhalt der Datei wieder, also man erkennt den Inhalt nicht.
Das große Problem ist jetzt, die TIF-Dateien so zu benennt, dass es dem Inhalt entspricht!
Vorteil: Diesen bestimmten Namen findet man im jeden Dokument genau an einer Stelle!

Also heißt das, wir brauchen eine OCR-Software z.B. Abbyy Finereader der die Email öffnet -> den Namen in dieser bestimmten Zeile entnimmt -> und das Dokument umbenennt -> am besten die Datei dahin speichert, wo man es haben möchte.

Bisher hat das eine unserer Mitarbeiterin gemacht ;-(
Das heißt es Kostet viel Zeit, zweitens machen Menschen Fehler (vertippen etc.)…

Das große Ziel ist es, wenn wir das geschafft haben, diese Faxe in eine vorhandene Datenbank einzupflegen und den zugehörigen Aufträgen zuzuordnen.

Jetzt seit Ihr gefragt, wie bekomme ich das hin?

Boah, ich glaube es ist einigermaßen rausgekommen was ich beabsichtige.
Wenn nicht, fragt bitte nach!

Danke im Voraus!

Mit freundlichen Grüßen

Abdel
Mitglied: filippg
22.02.2007 um 13:51 Uhr
Hallo,

tja, das Problem dürfte die OCR sein. Ich kenne keine, die über die Kommandozeile bedienbar ist, kenne mich bei OCR aber auch sehr wenig aus.
Was kein Problem ist, ist eine eMail zu parsen, den Anhang herauszuziehen, dort aus einer Grafik einen bestimmten Bereich herauszuschneiden (steht der Name immer an einer fixen absoluten Position?) und in eine Datei zu speichern. Den Dateinamen könnte man bei einem Kommandozeilenprogramm mit übergeben, nach dessen Lauf das Ergebnis (z.B. eine .txt-Datei) auswerten und das ganze unter einem neuen Namen abspeichern. Lässt sich beispielsweise in C# alles halbwegs unaufwendig erledigen (TIF müsste vom .NET-Framework unterstützt werden, sollte man aber nochmal nachlesen).

Die Frage bleibt aber auch noch, ob man sich auf die OCR hundertprozentig verlassen möchte.
Und wenn das mit der OCR nicht klappt könnte man den Aufwand der Mitarbeiterin verringern, in dem man ein Programm macht, dass alles bis auf eben OCR macht; die Mitarbeiterin bekommt dann einfach das Fax/den entsprechenden Ausschnitt angezeigt, gibt in ein Textfeld den Namen ein und klickt auf speichern (eMail öffnen, Anhang öffnen, Speicherpfad eingeben entfällt). Damit hätte man auch gleich eine manuelle Kontrolle.

Filipp
Bitte warten ..
Mitglied: ratzla
22.02.2007 um 14:00 Uhr
Das extrahieren des mail Anhangs lässt sich grundsätzlich mit procmail (unter Unix/Linux) realisieren.
Was es da für den Kleinweich-Austauscher (MS Exchange) gibt, weiss ich nicht.

Leider gibt es aber für Linux -nach meinem Wissensstand- noch keine wirklich gute OCR Software.

Noch ein Haken: Der Finereader (zumindest der den ich kenne) liefert nur Office Formate und ist auch nicht über Kommandozeile ansteuerbar. Aber ich glaube es gibt da eine Serverversion die so was kann.
Noch was: Die Fehlerrate von OCR ist relativ hoch, gerade bei Faxen. Man muss außerdem noch ganz bestimmte Textstellen im Fax erkennen (ich nehme nicht an dass das die Info zum Generieren in der ersten Zeile steht).
Die Sache wird vermutlich wirklich eine Herausforderung.
Bitte warten ..
Ähnliche Inhalte
Batch & Shell
gelöst Batch xls nach aktuellem Datum auslesen und email senden (14)

Frage von michi-ffm zum Thema Batch & Shell ...

Visual Studio
Vb.net Datenfelder aus Word 2003 Dokument auslesen (3)

Frage von Herbrich19 zum Thema Visual Studio ...

Windows Server
gelöst Domänen Benutzer via RDP Anmeldung am WDC für spezielle Aufgabe (11)

Frage von zeroblue2005 zum Thema Windows Server ...

Neue Wissensbeiträge
Tipps & Tricks

Wie Hackt man sich am besten in ein Computernetzwerk ein

(29)

Erfahrungsbericht von Herbrich19 zum Thema Tipps & Tricks ...

Humor (lol)

Bester Vorschlag eines Supporttechnikers ever: APC

(15)

Erfahrungsbericht von DerWoWusste zum Thema Humor (lol) ...

Windows Server

Exchange 2010 Active Directory und Windows Server 2016

(4)

Erfahrungsbericht von Herbrich19 zum Thema Windows Server ...

Heiß diskutierte Inhalte
Internet
gelöst Mitarbeiter surft auf unerwünschter Seite - Wie damit umgehen? (44)

Frage von sabines zum Thema Internet ...

Netzwerke
Wie erstelle ich ein Intranet (19)

Frage von Leonardnet zum Thema Netzwerke ...

LAN, WAN, Wireless
gelöst Eintägige Netzwerkunterbrechung trotz Backupleitung (15)

Frage von iAmbricksta zum Thema LAN, WAN, Wireless ...

Windows Server
Server 2012 R2 - Zugriff Verweigert bei jeglicher Tätigkeit (13)

Frage von DarkLevi zum Thema Windows Server ...