﻿from sklearn.feature_extraction.text import CountVectorizer

# 1 - création et calcul du sac de mots
vectorizer = CountVectorizer()

# 2 - le corpus (3 documents)
corpus = ['un jour ici et la' ,  'demain mais pas ici' ,  'la la la lere']

# 3 – calcul du sac
bow = vectorizer.fit_transform(corpus)
 