CoolFace
Apppublic

kenken999/selenium_web_scrape2

sourceHugging Faceapache-2.0updated 3y agoView on Hugging Face
1likes
extract.py27 linesDownload Raw Back to root
1from selenium import webdriver2from selenium.common.exceptions import WebDriverException3from PIL import Image4from io import BytesIO5 6def take_webdata(url):7    options = webdriver.ChromeOptions()8    options.add_argument('--headless')9    options.add_argument('--no-sandbox')10    options.add_argument('--disable-dev-shm-usage')11 12    try:13        wd = webdriver.Chrome(options=options)14        wd.set_window_size(1080, 720)  # Adjust the window size here15        wd.get(url)16        wd.implicitly_wait(5)17        # Get the page title18        page_title = wd.title19        screenshot = wd.get_screenshot_as_png()20 21    except WebDriverException as e:22        return Image.new('RGB', (1, 1)), page_title23    finally:24        if wd:25            wd.quit()26 27    return Image.open(BytesIO(screenshot)) , page_title