leicht OT: wie geht Ihr mit Spam um, der gezielt den Bayes (oder anderen) Filter entkräften soll?
Moin, nachdem ich dank eurer tatkräftigen Mithilfe meinen SA nun ganz ordentlich am rennen habe und das Spam Problem an sich im Griff ist, hätte ich noch folgende Frage: Seit 1-2 Monaten tauchen immer diese Spam-Mails auf die im Betreff und im Body wahllos irgendwelche englischen "Dictionary words" verbraten. Ziel davon ist sicherlich, irgendwelche content-Filter zu irritieren. Bisher waren das i.d.R. nur 3 Zeilen "Vokabeln" ... heute hab' ich die erste Spam mail bekommen mit rd. 30 Zeilen davon. Wenn ich die alle als "spam" in den Bayes schmeisse, ist es dann nicht eine Frage der Zeit, bis der auf englische Mails gar nicht mehr anspringt? Auf der anderen Seite werden diese fraglichen Spams derzeit noch als 99-100% Spam Wahrscheinlichkeit getaggt. - Daher meine Überlegung: Wenn ich SA noch mal Spam zum lernen gebe, sortiere ich die vorher manuell aus. --- wobei das natürlich eine ätzende Arbeit ist. Plan B wäre, SA nur noch false Positives/Negatives zum Lernen zu geben. Bei ca. 4500 Ham und 1500 Spam Messages sollte der Bayes ja eigentlich genügend Futter haben, oder? ... wie macht Ihr sowas in der Praxis? Danke Stefan. -- / Stefan Ulrich Hegner aka "Hegi" - Loehne/ Westfalen - Germany \ | stefan@hegner-online.de, my Cyberhome http://www.hegner-web.de| \ GPG-Fprint D9DB 51BD 2DA6 9B3A 41CB 0287 05A1 8D11 38BA CE91 /
Teilnehmer (3)
-
Cord Beermann
-
Florian Lohoff
-
Stefan Ulrich Hegner