Top-Themen

AppleEntwicklungHardwareInternetLinuxMicrosoftMultimediaNetzwerkeOff TopicSicherheitSonstige SystemeVirtualisierungWeiterbildungZusammenarbeit

Aktuelle Themen

Administrator.de FeedbackApache ServerAppleAssemblerAudioAusbildungAuslandBackupBasicBatch & ShellBenchmarksBibliotheken & ToolkitsBlogsCloud-DiensteClusterCMSCPU, RAM, MainboardsCSSC und C++DatenbankenDatenschutzDebianDigitiales FernsehenDNSDrucker und ScannerDSL, VDSLE-BooksE-BusinessE-MailEntwicklungErkennung und -AbwehrExchange ServerFestplatten, SSD, RaidFirewallFlatratesGoogle AndroidGrafikGrafikkarten & MonitoreGroupwareHardwareHosting & HousingHTMLHumor (lol)Hyper-VIconsIDE & EditorenInformationsdiensteInstallationInstant MessagingInternetInternet DomäneniOSISDN & AnaloganschlüsseiTunesJavaJavaScriptKiXtartKVMLAN, WAN, WirelessLinuxLinux DesktopLinux NetzwerkLinux ToolsLinux UserverwaltungLizenzierungMac OS XMicrosoftMicrosoft OfficeMikroTik RouterOSMonitoringMultimediaMultimedia & ZubehörNetzwerkeNetzwerkgrundlagenNetzwerkmanagementNetzwerkprotokolleNotebook & ZubehörNovell NetwareOff TopicOpenOffice, LibreOfficeOutlook & MailPapierkorbPascal und DelphiPeripheriegerätePerlPHPPythonRechtliche FragenRedHat, CentOS, FedoraRouter & RoutingSambaSAN, NAS, DASSchriftartenSchulung & TrainingSEOServerServer-HardwareSicherheitSicherheits-ToolsSicherheitsgrundlagenSolarisSonstige SystemeSoziale NetzwerkeSpeicherkartenStudentenjobs & PraktikumSuche ProjektpartnerSuseSwitche und HubsTipps & TricksTK-Netze & GeräteUbuntuUMTS, EDGE & GPRSUtilitiesVB for ApplicationsVerschlüsselung & ZertifikateVideo & StreamingViren und TrojanerVirtualisierungVisual StudioVmwareVoice over IPWebbrowserWebentwicklungWeiterbildungWindows 7Windows 8Windows 10Windows InstallationWindows MobileWindows NetzwerkWindows ServerWindows SystemdateienWindows ToolsWindows UpdateWindows UserverwaltungWindows VistaWindows XPXenserverXMLZusammenarbeit

Aufgabe für Anspruchsvolle! Dateiinhalt einer Email auslesen

Frage Entwicklung

Mitglied: Abdelhalim

Abdelhalim (Level 1) - Jetzt verbinden

22.02.2007, aktualisiert 14:00 Uhr, 6100 Aufrufe, 2 Kommentare, 1 Danke

Ich habe eine wirkliche Aufgabe für Anspruchsvolle! (Möglicherweise Lösbar)
Also wir erhalten im Unternehmen immer wieder Emails von einer Tochtergesellschaft. Diese Emails beinhalten gescannte Faxe im Anhang. Der Name dieser TIF-Dateien lautet meistens so: "pp000000", somit spiegeln sie nicht den Inhalt der Datei wieder, also man erkennt den Inhalt nicht.
Das große Problem ist jetzt, die TIF-Dateien so zu benennt, dass es dem Inhalt entspricht!
Vorteil: Diesen bestimmten Namen findet man im jeden Dokument genau an einer Stelle!

Also heißt das, wir brauchen eine OCR-Software z.B. Abbyy Finereader der die Email öffnet -> den Namen in dieser bestimmten Zeile entnimmt -> und das Dokument umbenennt -> am besten die Datei dahin speichert, wo man es haben möchte.

Bisher hat das eine unserer Mitarbeiterin gemacht ;-(
Das heißt es Kostet viel Zeit, zweitens machen Menschen Fehler (vertippen etc.)…

Das große Ziel ist es, wenn wir das geschafft haben, diese Faxe in eine vorhandene Datenbank einzupflegen und den zugehörigen Aufträgen zuzuordnen.

Jetzt seit Ihr gefragt, wie bekomme ich das hin?

Boah, ich glaube es ist einigermaßen rausgekommen was ich beabsichtige.
Wenn nicht, fragt bitte nach!

Danke im Voraus!

Mit freundlichen Grüßen

Abdel
Mitglied: filippg
22.02.2007 um 13:51 Uhr
Hallo,

tja, das Problem dürfte die OCR sein. Ich kenne keine, die über die Kommandozeile bedienbar ist, kenne mich bei OCR aber auch sehr wenig aus.
Was kein Problem ist, ist eine eMail zu parsen, den Anhang herauszuziehen, dort aus einer Grafik einen bestimmten Bereich herauszuschneiden (steht der Name immer an einer fixen absoluten Position?) und in eine Datei zu speichern. Den Dateinamen könnte man bei einem Kommandozeilenprogramm mit übergeben, nach dessen Lauf das Ergebnis (z.B. eine .txt-Datei) auswerten und das ganze unter einem neuen Namen abspeichern. Lässt sich beispielsweise in C# alles halbwegs unaufwendig erledigen (TIF müsste vom .NET-Framework unterstützt werden, sollte man aber nochmal nachlesen).

Die Frage bleibt aber auch noch, ob man sich auf die OCR hundertprozentig verlassen möchte.
Und wenn das mit der OCR nicht klappt könnte man den Aufwand der Mitarbeiterin verringern, in dem man ein Programm macht, dass alles bis auf eben OCR macht; die Mitarbeiterin bekommt dann einfach das Fax/den entsprechenden Ausschnitt angezeigt, gibt in ein Textfeld den Namen ein und klickt auf speichern (eMail öffnen, Anhang öffnen, Speicherpfad eingeben entfällt). Damit hätte man auch gleich eine manuelle Kontrolle.

Filipp
Bitte warten ..
Mitglied: ratzla
22.02.2007 um 14:00 Uhr
Das extrahieren des mail Anhangs lässt sich grundsätzlich mit procmail (unter Unix/Linux) realisieren.
Was es da für den Kleinweich-Austauscher (MS Exchange) gibt, weiss ich nicht.

Leider gibt es aber für Linux -nach meinem Wissensstand- noch keine wirklich gute OCR Software.

Noch ein Haken: Der Finereader (zumindest der den ich kenne) liefert nur Office Formate und ist auch nicht über Kommandozeile ansteuerbar. Aber ich glaube es gibt da eine Serverversion die so was kann.
Noch was: Die Fehlerrate von OCR ist relativ hoch, gerade bei Faxen. Man muss außerdem noch ganz bestimmte Textstellen im Fax erkennen (ich nehme nicht an dass das die Info zum Generieren in der ersten Zeile steht).
Die Sache wird vermutlich wirklich eine Herausforderung.
Bitte warten ..
Neuester Wissensbeitrag
Ähnliche Inhalte
VB for Applications
gelöst Bestimmte Spalten aus CSV-Datei auslesen (VBS) (9)

Frage von Gurkenhobel zum Thema VB for Applications ...

Batch & Shell
Eventlog Druckjobs mit VBS auslesen (2)

Frage von joni2000de zum Thema Batch & Shell ...

Assembler
Assembler-Aufgabe (4)

Frage von How-To zum Thema Assembler ...

Batch & Shell
gelöst Appx aus Image auslesen und entfernen (9)

Frage von Markus2016 zum Thema Batch & Shell ...

Heiß diskutierte Inhalte
Windows Userverwaltung
Ausgeschiedene Mitarbeiter im Unternehmen - was tun mit den AD Konten? (32)

Frage von patz223 zum Thema Windows Userverwaltung ...

LAN, WAN, Wireless
FritzBox, zwei Server, verschiedene Netze (21)

Frage von DavidGl zum Thema LAN, WAN, Wireless ...

Viren und Trojaner
Aufgepasst: Neue Ransomware Goldeneye verbreitet sich rasant (20)

Link von Penny.Cilin zum Thema Viren und Trojaner ...

Windows Netzwerk
Windows 10 RDP geht nicht (18)

Frage von Fiasko zum Thema Windows Netzwerk ...