﻿from sklearn.feature_extraction.text import CountVectorizer

# 1 - création d'un sac de mot… vide
vectorizer = CountVectorizer()

# 2 - le corpus (3 documents)
corpus = ['un jour ici et là' ,  'demain mais pas ici' ,  'la la la lere']

# 3 – calcul du sac
bow = vectorizer.fit(corpus)
bow = vectorizer.transform(corpus)


 