|
|
贝叶斯要不断的学习垃圾邮件,这些垃圾邮件样本应该包括了大量的已知垃圾邮件样本以及最新的变化了的垃圾邮件样本。这样才能达到最好的过滤效果,对最新的垃圾邮件样本的学习通常需要两周左右的时间.
同时贝叶斯也要学习好的邮件,这样在其进行概率分析的能更准确的判断你所收到的邮件是否为垃圾邮件.
p(A)=p(A)/[p(A)+p(B)],其中p(A)是垃圾邮件的概率,p(B)为正常邮件的概率,从上面可以看出,学习正常邮件是必须的,不象你说的不能学习正常邮件的.
重复让其学习同一封邮件会让其Token概率失真,所以建议不要重复学习同一封邮件. |
|