代码如下
from bs4 import BeautifulSoup #网页解析,获取数据
import sys #正则表达式,进行文字匹配
import re
import urllib.request,urllib.error #指定url,获取网页数据
import xlwt #使用表格
import sqlite3
import lxml
以上是引用的库,引用库的方法很简单,直接上图:
上面第一步算有了,下面分模块来,步骤算第二步来:
这个放在开头
def main():
baseurl ="https://movie.douban.com/top250?start="
2022-06-26 22:34:15
134KB
数据
豆瓣
1