Nous nous sommes rendues compte d'un problème lorque nous faisions tourner plusieurs fois le programme. En effet, pour un certains nombre d'urls, l'aspiration de la page ne se fait pas. Nous avons donc voulu comprendre la raison de cet échec et il s'avère que les sites web de quotidiens français ou internationaux comme le courrier international protègent leurs données et empêchent l'extraction d'informations et par conséquent l'aspiration de la page web.