- # 项目介绍: 爬取今日头条街拍图片 # 思路: # 1、通过观察列表页面,获取ajax的请求连接和参数 # 2、解析获取的json文件,获取图集连接 # 3、获取图集详情页 # 4、解析详情页,beautifulsoup解析出图集名称,re解析出图集连接 # 5、图集名称和图集链接存入mongodb # 6、下载图片,并保存到本地文件夹 # 7、调试完成后,开启多进程... # 项目介绍: 爬取今日头条街拍图片 # 思路: # 1、通过观察列表页面,获取ajax的请求连接和参数 # 2、解析获取的json文件,获取图集连接 # 3、获取图集详情页 # 4、解析详情页,beautifulsoup解析出图集名称,re解析出图集连接 # 5、图集名称和图集链接存入mongodb # 6、下载图片,并保存到本地文件夹 # 7、调试完成后,开启多进程...
- 安装 pip install chardet1 检测byte字节编码 confidence字段,表示检测的概率是1.0(即100%) import chardet ret = chardet.detect(b"hello world") print(ret) # {'encoding': 'ascii', 'confidence': 1.0} data =... 安装 pip install chardet1 检测byte字节编码 confidence字段,表示检测的概率是1.0(即100%) import chardet ret = chardet.detect(b"hello world") print(ret) # {'encoding': 'ascii', 'confidence': 1.0} data =...
- JavaScript age1 = 23 ; age2 = "23" ; // 值相等 console.log(age1 == age2) ; // true // 值和类型都相等 console.log(age1 === age2) ; // false 12345678910 PHP <?php $age1 = 23 ; $age2 = "23... JavaScript age1 = 23 ; age2 = "23" ; // 值相等 console.log(age1 == age2) ; // true // 值和类型都相等 console.log(age1 === age2) ; // false 12345678910 PHP <?php $age1 = 23 ; $age2 = "23...
- Requests Python标准库中提供了:urllib、urllib2、httplib等模块以供Http请求, 但是,它的 API 太渣了。它是为另一个时代、另一个互联网所创建的。 它需要巨量的工作,甚至包括各种方法覆盖,来完成最简单的任务。 Requests 是使用 Apache2 Licensed 许可证的 基于Python开发的HTTP 库, 其在P... Requests Python标准库中提供了:urllib、urllib2、httplib等模块以供Http请求, 但是,它的 API 太渣了。它是为另一个时代、另一个互联网所创建的。 它需要巨量的工作,甚至包括各种方法覆盖,来完成最简单的任务。 Requests 是使用 Apache2 Licensed 许可证的 基于Python开发的HTTP 库, 其在P...
- 数字number 整数int浮点数float复数complex 小整数池:-5 ~ 257 布尔值bool TrueFalse 三元运算符:result = value1 if condition else value2 字节bytes与字符串string 字节 –> decode –> 字符串字符串 –> encode –> 字节... 数字number 整数int浮点数float复数complex 小整数池:-5 ~ 257 布尔值bool TrueFalse 三元运算符:result = value1 if condition else value2 字节bytes与字符串string 字节 –> decode –> 字符串字符串 –> encode –> 字节...
- 设计:自顶向下,分解问题 执行:自底向上,单元测试 软件开发模式 瀑布模式 螺旋模式 快速原型模型 喷泉模式 混合模式 敏捷开发模式 软件开发生命周期 确定问题 可行性分析 系统分析 系统设计 ... 设计:自顶向下,分解问题 执行:自底向上,单元测试 软件开发模式 瀑布模式 螺旋模式 快速原型模型 喷泉模式 混合模式 敏捷开发模式 软件开发生命周期 确定问题 可行性分析 系统分析 系统设计 ...
- 发布消息 # -*- coding: utf-8 -*- import redis redis_con = redis.Redis(host='127.0.0.1') redis_con.publish(channel='test', message='hi-1') 12345678 订阅消息 # -*- coding: utf-8 -*- import... 发布消息 # -*- coding: utf-8 -*- import redis redis_con = redis.Redis(host='127.0.0.1') redis_con.publish(channel='test', message='hi-1') 12345678 订阅消息 # -*- coding: utf-8 -*- import...
- 当使用requests的get下载大文件/数据时,建议使用使用stream模式。 当把get函数的stream参数设置成False时,它会立即开始下载文件并放到内存中,如果文件过大,有可能导致内存不足。 当把get函数的stream参数设置成True时,它不会立即开始下载,当你使用iter_content或iter_lines遍历内容或访问内容属性时才开始下载。需要... 当使用requests的get下载大文件/数据时,建议使用使用stream模式。 当把get函数的stream参数设置成False时,它会立即开始下载文件并放到内存中,如果文件过大,有可能导致内存不足。 当把get函数的stream参数设置成True时,它不会立即开始下载,当你使用iter_content或iter_lines遍历内容或访问内容属性时才开始下载。需要...
- 1、准备一个项目文件夹 mkdir tmp && cmd tmp 1 2、准备两个文件,主文件__main__.py调用 hello.py # -*- coding:utf-8 -*- # __main__.py import hello print("main") 123456 # -*- coding:utf-8 -*- # hello... 1、准备一个项目文件夹 mkdir tmp && cmd tmp 1 2、准备两个文件,主文件__main__.py调用 hello.py # -*- coding:utf-8 -*- # __main__.py import hello print("main") 123456 # -*- coding:utf-8 -*- # hello...
- 思路: 读取文件名检测文件是否存在打开文件检测文件大小发送文件大小和MD5值给客户端等客户端确认开始边读边发数据MD5验证 # 服务器端 import socket import os import hashlib server = socket.socket() server.bind(("localhost", 6969)) # 绑定监听端口 serv... 思路: 读取文件名检测文件是否存在打开文件检测文件大小发送文件大小和MD5值给客户端等客户端确认开始边读边发数据MD5验证 # 服务器端 import socket import os import hashlib server = socket.socket() server.bind(("localhost", 6969)) # 绑定监听端口 serv...
- 排序方法 2.x的代码移植到3.x时,需要将cmp函数转化为key函数 # Python2 list.sort(cmp=None, key=None, reverse=False) # Python3 list.sort(key=None, reverse=False) 12345 排序有两个方法 list.sort() # list本身将被修改, 返回N... 排序方法 2.x的代码移植到3.x时,需要将cmp函数转化为key函数 # Python2 list.sort(cmp=None, key=None, reverse=False) # Python3 list.sort(key=None, reverse=False) 12345 排序有两个方法 list.sort() # list本身将被修改, 返回N...
- 快速排序 取一个元素p(第一个元素),使元素p归位 列表被p分成两部分,左边都比p小,右边都比p大 递归完成排序 算法关键点 整理递归(递归深度) 排序方法最好情况一般情况最坏情况快速排序O(nlogn)O(nlogn)O(n^2)冒泡排序O(n)O(n^2)O(n^2) 代码实现 import random # 分区函数 def partition... 快速排序 取一个元素p(第一个元素),使元素p归位 列表被p分成两部分,左边都比p小,右边都比p大 递归完成排序 算法关键点 整理递归(递归深度) 排序方法最好情况一般情况最坏情况快速排序O(nlogn)O(nlogn)O(n^2)冒泡排序O(n)O(n^2)O(n^2) 代码实现 import random # 分区函数 def partition...
- 本文总结了与Scrapy框架相关的一些开源工具 1、scrapyd 项目地址:https://github.com/scrapy/scrapyd 文档: https://scrapyd.readthedocs.io/ Scrapyd 是一个运行 Scrapy 爬虫程序的服务 pip install scrapyd scrapyd # 启动服务 123 环... 本文总结了与Scrapy框架相关的一些开源工具 1、scrapyd 项目地址:https://github.com/scrapy/scrapyd 文档: https://scrapyd.readthedocs.io/ Scrapyd 是一个运行 Scrapy 爬虫程序的服务 pip install scrapyd scrapyd # 启动服务 123 环...
- 1、整数,整数运算永远是精确的,0x前缀表示16进制 2、浮点数,科学计数法,e表示代替10 3、字符串,‘’或者“”包围 4、布尔值,注意大小写:True,False,布尔运算:and,or,not 5、空值,None,不能理解为0,因为0是有意义的,而None是一个特殊的空值 变量:大... 1、整数,整数运算永远是精确的,0x前缀表示16进制 2、浮点数,科学计数法,e表示代替10 3、字符串,‘’或者“”包围 4、布尔值,注意大小写:True,False,布尔运算:and,or,not 5、空值,None,不能理解为0,因为0是有意义的,而None是一个特殊的空值 变量:大...
- 通过关键字global声明为全局变量,可修改全局变量的值 var1 = 1 # 定义全局变量 def change_val(): var1 = 5 # 定义局部变量 print("change_val after val:",var1) def change_val_by_global(): global var1 # 声明全局变量 var1 = 5 pr... 通过关键字global声明为全局变量,可修改全局变量的值 var1 = 1 # 定义全局变量 def change_val(): var1 = 5 # 定义局部变量 print("change_val after val:",var1) def change_val_by_global(): global var1 # 声明全局变量 var1 = 5 pr...
上滑加载中
推荐直播
-
用码道,让你的AI作品三步上朋友圈2026/08/04 周二 19:00-20:00
林华鼎-华为云AI开发者运营负责人
从入门 · 到做AI应用 · 到企业级开发。不教编程,只教用AI · 零代码、有产出、能带走、可炫耀 · 每课人人动手实操
回顾中 -
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
即将直播
热门标签