聊天尬死名场面，你遇到过吗？教你一键获取斗图表情包，晋升聊天达人

2023年7月30日上午9:53 • 人工智能 • 阅读 77

大家好呀，我是辣条。

写这篇文章的灵感来源于之前和朋友的聊天，真的无力吐槽了，想发适合的表情包怼回去却发现收藏的表情包就那几个，就想着是不是可以爬取一些表情包，再也不用尬聊了。

先给大家看看我遇到的聊天最尬的场面：

斗图吧图片采集

*
– 抓取目标
– 工具使用
– 重点内容学习
– 项目思路分析
– 整理需求
– 简易源码分享

; 抓取目标

网站：斗图吧

; 工具使用

开发环境：win10、python3.7
开发工具：pycharm、Chrome
工具包：requests、etree

重点内容学习

1.Q队列储存数据信息
2.py多线程使用方法
3.xpath语法学习

项目思路分析

根据你需要的关键字搜索对应的图片数据
搜索的关键字和页数根据改变对应的url
https://www.doutula.com/search?type=photo&more=1&keyword={}&page={}
将对应的url地址保存在page队列里

    page_q = Queue()
    img_q = Queue()
    for x in range(1, 11):
        url = 'https://www.doutula.com/search?type=photo&more=1&keyword=%E7%A8%8B%E5%BA%8F%E5%91%98&page={}'.format(x)
        page_q.put(url)

通过xpath方式提取当前页面的url地址以及图片的名字
将提取到的图片和地址存储在img队列里

    def parse_page(self, url):
        response = requests.get(url, headers=self.headers).text

        html = etree.HTML(response)
        images = html.xpath('//div[@class="random_picture"]')
        for img in images:
            img_url = img.xpath('.//img/@data-original')

            print(img_url)
            alt = img.xpath('.//p/text()')
            for name, new_url in zip(alt, img_url):
                filename = re.sub(r'[?？.，。！!*\\/|]', '', name) + ".jpg"

                self.img_queue.put((new_url, filename))

根据图片地址下载保存图片
保存图片是要根据图片url来判断保存的后缀（我统一保存的jpg，问就是因为懒癌晚期）

整理需求

创建两个线程类，一个用来提取网页图片数据，一个保存图片数据
创建两个队列，一个保存page的url，一个保存图片的url和名字
通过xpath的方法提取出网址的图片地址

简易源码分享

import requests
from lxml import etree
import re
from queue import Queue
import threading

class ImageParse(threading.Thread):
    def __init__(self, page_queue, img_queue):
        super(ImageParse, self).__init__()
        self.page_queue = page_queue
        self.img_queue = img_queue
        self.headers = {
        'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/87.0.4280.88 Safari/537.36'
    }

    def run(self):
        if self.page_queue.empty():
            break
        url = self.page_queue.get()
        self.parse_page(url)

    def parse_page(self, url):
        response = requests.get(url, headers=self.headers).text

        html = etree.HTML(response)
        images = html.xpath('//div[@class="random_picture"]')
        for img in images:
            img_url = img.xpath('.//img/@data-original')

            print(img_url)
            alt = img.xpath('.//p/text()')
            for name, new_url in zip(alt, img_url):
                filename = re.sub(r'[?？.，。！!*\\/|]', '', name) + ".jpg"

                self.img_queue.put((new_url, filename))

class Download(threading.Thread):
    def __init__(self, page_queue, img_queue):
        super(Download, self).__init__()
        self.page_queue = page_queue
        self.img_queue = img_queue

    def run(self):

        if self.img_queue.empty() and self.page_queue.empty():
            break
        img_url, filename = self.img_queue.get()
        with open("表情包/" + filename, "wb")as f:
            response = requests.get(img_url).content
            f.write(response)
            print(filename + '下载完成')

def main():

    page_q = Queue()
    img_q = Queue()
    for x in range(1, 11):
        url = 'https://www.doutula.com/search?type=photo&more=1&keyword=%E7%A8%8B%E5%BA%8F%E5%91%98&page={}'.format(x)
        page_q.put(url)

    for x in range(5):
        t = ImageParse(page_q, img_q)
        t.start()
        t = Download(page_q, img_q)
        t.start()

if __name__ == '__main__':
    main()

PS：表情包在手，聊天永不尬，没什么事是一个表情包解决不了的，如果有那就多发几个！对你有用的话给辣条一个三连吧，感谢啦！

Original: https://blog.csdn.net/AI19970205/article/details/117925762
Author: 五包辣条！
Title: 聊天尬死名场面，你遇到过吗？教你一键获取斗图表情包，晋升聊天达人

原创文章受到原创版权保护。转载请注明出处：https://www.johngo689.com/723866/

转载文章受原作者版权保护。转载请注明原作者出处！

人工智能

【自取】最近整理的，有需要可以领取学习：

Linux核心资料大放送~

全栈面试题汇总（持续更新&可下载）

一个提高学习100%效率的工具！

【超详细】深度学习面试题目！

LeetCode Python刷题答案下载！

LeetCode Java版刷题答案下载！

LeetCode C++ 版本，抓紧保存！

LeetCode GO语言刷题答案下载！

[ 目标检测 ] 经典网络模型2——Fast R-CNN 详解与复现

🤵 Author ：Horizon Max ✨ 编程技巧篇：各种操作小结 🎇 机器视觉篇：会变魔术 OpenCV 💥 深度学习篇：简单入门 PyTorch 🏆 神经网络篇：经典网络…

人工智能 2023年7月10日
0072
基于EasyDL搭建音频在线实时分类系统

文章目录 * – 搭建音频在线实时分类系统 – + 1. easydl 训练音频分类模型 + * 1.1 上传数据并训练音频分类模型 * 1.2 发布训练好…

人工智能 2023年6月30日
0069
对抗攻击算法总结论文集合（白盒、黑盒、目标检测、对抗训练等）

只是一个自己看过的论文小汇总，还不能当综述，但也包含了很多经典的对抗攻击算法，方便回顾和查询，自己看的第一篇综述是：Advances in adversarial attacks …

人工智能 2023年7月27日
0051
解决在win10环境下使用python 3 来搭建mumble 的client (没有启动界面,可以实现按键PPT,或者语音激活) 过程中出现的问题

1.关于如何使用python 3 来搭建mumble 的client,已经有大佬在github做好了,只需要down下源码自己调试即可 pymumble的github地址:Issu…

人工智能 2023年5月25日
0078
Python的5大就业方向，学会一个都是赚

Python语言是这几年比较火爆的编程语言，不少人都开始报名Python培训进行Python的学习，那学会Python语言就只可以使用爬虫吗？并不是的，那Python语言分为那几个…

人工智能 2023年6月19日
0079
RGB转频域分析

转频域的方法一般有三种，dft，dct，dwt.频域一般是在压缩中使用，可以减少图片中冗余信息，保留有用信息，明确一点就是去除部分低频信息，保留高频信息，高频信息一般指的是边缘等，…

人工智能 2023年6月18日
0065
openpose的一些个人理解

一直都是在做一些目标检测的研究工作，近期开始看一些有关姿态检测的内容，其中最经典的就是openpose这个框架，后面很多动作识别、姿态检测也大多是在该网络上进行改进，比如Real-…

人工智能 2023年7月28日
0058
【HOLE】论文浅读：Holographic Embeddings of Knowledge Graphs

; HOLE Holographic Embeddings of Knowledge Graphs基于向量的循环相关任务提出全息嵌入(holographic embedding…

人工智能 2023年6月4日
0076
高维数据PCA降维可视化(KNN分类)

在做机器学习的时候，经常会遇到三个特征以上的数据，这类数据通常被称为高维数据。数据做好类别分类后，通过二维图或者三维图进行可视化，对于高维数据可以通过 PCA(Princ…

人工智能 2023年6月15日
0064
无人驾驶动态避障策略调研 | 机器人动态避障策略 | 行人轨迹预测 | 机器人导航

目录 1.无人驾驶 2.无人驾驶避障 * 2.1运动障碍物检测 2.2运动障碍物碰撞轨迹预测 2.3运动障碍物避障 3.机器人导览避障场景 * 3.1 机器人动态避障&自主…

人工智能 2023年6月13日
0088
【GIS奇妙之旅】遥感图像分类技术

摘要: 图像分类根据各自在图像信息中所反映的不同特征，把不同类别的目标区分开来的图像处理方法。它利用计算机对图像进行定量分析，把图像或图像中的每个像元或区域划归为若干个类别中的某一…

人工智能 2023年5月31日
00103
花了不到1块5，玩了下全网最火的ChatGPT

啊哦~你想找的内容离你而去了哦内容不存在，可能为如下原因导致： ① 内容还在审核中 ② 内容以前存在，但是由于不符合新的规定而被删除 ③ 内容地址错误 ④ 作者删除了内容。可…

人工智能 2023年7月31日
0032
Ubuntu环境添加Anaconda和Jupyter的图标

在Ubuntu系统下安装Ananconda后是不会在桌面生成图标的。如果要打开JupyterNotebook需要在终端执行命令： jupyter notebook 这样的操作足够极…

人工智能 2023年6月4日
0068
结构化数据抽取成三元组_干货丨AI在数据防泄漏中的应用——知识图谱之知识抽取…

随着技术的不断发展，AI(Artificial Intelligence，人工智能)逐渐在社会经济发展的方方面面深入，成为信息化时代最重要的支柱技术之一。在数据安全领域领域，AI…

人工智能 2023年6月1日
0083
python 条件查询_查找满足条件的特定值-python

对于像这样的匹配问题,一种可能是进行完全合并,然后使用布尔级数对满足条件的所有行(对于该行)进行子集合并,并找到 max min 在所有可能的匹配中。因为这需要稍微不同的列和不同的…

人工智能 2023年7月8日
0051
CS224W 5 Graph as Matrix: PageRank,Random Walks and Embeddings

目录 Link Analysis approaches—计算图中节点重要性基本思路随机邻接矩阵M M和Random Walk联系起来 M和eigenvector central…

人工智能 2023年6月30日
0082

2024 年 4 月
一	二	三	四	五	六	日
1	2	3	4	5	6	7
8	9	10	11	12	13	14
15	16	17	18	19	20	21
22	23	24	25	26	27	28
29	30