Python 係咪用Selenium 係Web Scraping 唔到Bloomberg?
如題,我宜家都係想去Bloomberg 去拎恒生指數的PE 數值,如下圖:
但有兩個問題:
1)Bloomberg detect 我係bot, 看下圖:
2) Bloomberg 個網成日load 緊野,由於網頁一直load, python 會等個website load 晒先會執行下一行code,變相都係拎唔到數值。
import ws_functions.config as ws_config
import ws_functions.cust_functions as ws_functions
import time
import sqlite3
from selenium import webdriver
from selenium.webdriver.chrome.options import Options
from selenium.webdriver.common.keys import Keys
ws_functions.print_runtime()
bloomberg_frontpage_url = 'https://www.bloomberg.com/asia'
options = webdriver.ChromeOptions()
options.binary_location = "/Applications/Google Chrome.app"
# chrome_driver_binary = '/Users/seansiao/Documents/workspace/HK Property/Valuation/chromedriver'
chrome_options = Options()
#chrome_options.add_argument("--headless")
chrome_options.add_argument("window-size=1920,1080")
browser=webdriver.Chrome(chrome_options=chrome_options, executable_path=r'/Users/ws_fingear/Documents/workspace/chromedriver')
chrome_options = Options()
browser.get(bloomberg_frontpage_url)
browser.implicitly_wait(10)
try:
time.sleep(6)
browser.find_element_by_xpath('//*[@id="nav-bar-search-button"]').click() #Click "Search"
time.sleep(5)
browser.find_element_by_xpath('//*[@id="navi-search-input"]').send_keys('HSI') #Send 'HSI' to the searchbar
time.sleep(5)
browser.find_element_by_partial_link_text('HSI:IND').click()
time.sleep(5)
time.sleep(5)
HSI_PE = browser.find_element_by_xpath('//[@id="root"]/div/div/section[3]/div[3]/div[1]/div/div[1]/div[1]/div/span[2]').text
可唔可以有人救救我?感謝大家 |
|
|
附件:
您需要登錄才可以下載或查看附件。沒有帳號?註冊