在Naive Bayes中使用稀疏矩阵/在线学习(Python,scikit)

前端之家收集整理的这篇文章主要介绍了在Naive Bayes中使用稀疏矩阵/在线学习(Python,scikit)前端之家小编觉得挺不错的,现在分享给大家,也给大家做个参考。

我正在尝试在数据集上做Naive Bayes,该数据集有超过6,000,000个条目,每个条目有150k的特征.我试图从以下链接实现代码
Implementing Bag-of-Words Naive-Bayes classifier in NLTK

问题是(据我所知),当我尝试使用dok_matrix作为参数运行train-method时,它无法找到iterkeys(我已将OrderedDict的行与标签配对):

Traceback (most recent call last):
  File "skitest.py",line 96,in 

我的问题是,有没有办法通过条目(在线)教授分类器条目来避免使用稀疏矩阵,还是有一种稀疏矩阵格式,我可以在这种情况下有效地使用而不是dok_matrix?还是我错过了一些明显的东西?

谢谢你的时间.

猜你在找的Python相关文章