initial vault 2
This commit is contained in:
@@ -0,0 +1 @@
|
||||
Нормализация нужна, чтобы мы не переоценивали tf в длинных документах. В итоге нормализация - деление tf на длину документа (кол-во term)
|
||||
@@ -0,0 +1,3 @@
|
||||
Зачем вы вообще знаете про TF-IDF в наше время и как можете использовать в сложных моделях?
|
||||
TF-IDF - быстрый способ векторизации текста, который можно использовать для проверки гипотез
|
||||
Выделение фичей (так как можем получать важность слова и можем добавлять его)
|
||||
Reference in New Issue
Block a user