import requests
from bs4 import BeautifulSoup
res = requests.get('https://davelee-fun.github.io/')
soup = BeautifulSoup(res.content, 'html.parser')
data = soup.select('h4.card-text')
for item in data:
print (item.get_text().strip())
#헤더스값 필요한 경우 (접속 차단시)
import requests
from bs4 import BeautifulSoup
url = "https://finance.naver.com/marketindex/"
header = {"User-Agent" : "유저정보"}
res = requests.get(url, headers = header)
soup = BeautifulSoup(res.content, "html.parser")
print(soup.prettify())
from urllib.request import urlopen
from bs4 import BeautifulSoup
res = urlopen('https://davelee-fun.github.io/')
soup = BeautifulSoup(res, 'html.parser')
data = soup.select('h4.card-text')
for item in data:
print (item.get_text().strip())코드를 입력하세요
1) soup.p
2) soup.find("p")
1) soup.find("p", class_="inner-text second-item")
2) soup.find("p", {"class" : "inner-text second-item"})
3) soup.find_all("span", "value") #value 클래스
soup.find("p", {"class" : "inner-text second-item", "id", : "first"})
soup.find_all("p")
1) soup.find_all(id="pw-link")[0].text #리스트로 접근해서 text 불러오기
2) soup.find_all("p")[0].string
3) soup.find_all("p")[1].get_text()
links = soup.find_all("a")
1) links[0].get("href")
2) links[0]["herf"]
1) # : id
*id 태그는 하나만 존재한다
2) . : class
<div class="head_info point_dn">
<span class="value">1,373.00</span>
<span class="txt_krw"><span class="blind">원</span></span>
<span class="change"> 2.00</span>
<span class="blind">하락</span>
updown = exchangeList[0].select_one("div.head_info.point_dn>.blind").text
*띄어쓰기는 클래스 두개라는 뜻이므로 .으로 연결해주기
*>.blind는 앞의것의 바로 밑의 것이라는 뜻
3) > 바로 밑
"html.paser" / "lxml"
\n$10.2029 W. Chicago Ave'
\$\d+\.(\d+)?"
>
1. 달러 필수
2. 숫자가 여러개 있을 수도
3. 숫자 뒤에는 꼭 .을 만남
3. .뒤에는 숫자 여러개가 있을수도 있고 없을 수도 있고
$10.
len() = 4