用sklearn求大文本的tfidf特征？

依依雨柔

发布于
2017-06-26

上面的数据是从reuters数据集中取得7303个训练集，用sklearn对其取tfidf特征，得到的结果都是0，这是怎么回事？

当我从这些数据中取一部分时，对于这些少部分数据能够得到正确的tfidf结果。

python 机器学习 tfidf

阅读 5.2k

1 个回答

morriaty_the_murderer

发布于
2017-06-27

上代码，可能是你精度太低或者min_count导致的

比如词频是1，总词数1e9，对应的tf就是1e-9，被忽略了。

撰写回答

你尚未登录，登录后可以

和开发者交流问题的细节
关注并接收问题和回答的更新提醒
参与内容的编辑和改进，让解决方法与时俱进

推荐问题

相似问题

找不到问题？创建新问题