Python 生成词云:一篇文章生成漂亮词云图
from wordcloud import WordCloud
import jieba
def make_wordcloud(text_file, output='wordcloud.png'):
with open(text_file, 'r', encoding='
from wordcloud import WordCloud
import jieba
def make_wordcloud(text_file, output='wordcloud.png'):
with open(text_file, 'r', encoding='
import os def folder_size(path): total = 0 for root, _, files in os.walk(path): for name in files: try: total += os.path.
import os
import hashlib
from collections import defaultdict
def file_hash(path, chunk=8192):
h = hashlib.md5()
with open(path, 'rb') as f:
import osimport timefrom datetime import datetime def shutdown_at(hour, minute, restart=False): while True: now = datetime.now() if now.hour ==
import osimport requestsfrom bs4 import BeautifulSoupfrom urllib.parse import urljoin def download_images(url, folder='images'): os.makedirs(folder,
import subprocess
import os
def compress_video(src, dst, crf=28):
"""crf 越大压缩越狠,18~28 之间比较合适"""
cmd = [
'ffmpeg', '-i
import os
from moviepy.editor import VideoFileClip
def video_to_audio(folder):
for name in os.listdir(folder):
if not name.lower().endswith(('.
from gtts import gTTS def text_to_speech(text, output='output.mp3', lang='zh-cn'): tts = gTTS(text=text, lang=lang, slow=False) tts.save(o
import os
import pytesseract
from PIL import Image
# Windows 需指定 tesseract 路径
pytesseract.pytesseract.tesseract_cmd = r'C:\Program Files\Tesseract-OCR
from pypdf import PdfReader, PdfWriter
from reportlab.pdfgen import canvas
from reportlab.lib.pagesizes import A4
import io
def add_pdf_watermark(src, dst, tex
import os
from pdf2docx import Converter
def pdf_to_word(folder):
for name in os.listdir(folder):
if not name.lower().endswith('.pdf'):
import os
import win32com.client
def excel_to_pdf(folder):
excel = win32com.client.Dispatch('Excel.Application')
excel.Visible = False
for
from playwright.sync_api import sync_playwright
def html_to_pdf(url, output='page.pdf'):
with sync_playwright() as p:
browser = p.chromium.
from selenium import webdriverfrom selenium.webdriver.chrome.options import Options def screenshot(url, output='screenshot.png'): options = Options()
import osfrom pyzbar.pyzbar import decodefrom PIL import Image def decode_qrcodes(folder): for name in os.listdir(folder): if not name.lower().endswit
import qrcodefrom qrcode.image.styledpil import StyledPilImagefrom qrcode.image.styles.moduledrawers import RoundedModuleDrawer def gen_qrcode(data, output='
import os
from PIL import Image, ImageDraw, ImageFont
def add_watermark(folder, text='© 我的网站'):
out_dir = os.path.join(folder, 'waterm
import os
from PIL import Image
def compress_images(folder, quality=75, max_size=(1920, 1920)):
out_dir = os.path.join(folder, 'compressed')
os
import os
def batch_rename(folder, prefix='file_', start=1):
"""批量给文件夹里的文件加前缀+序号"""
files = sorted([f for f in os.listdir(folder
import os
import shutil
folder = './下载'
rules = {
'图片': ['.jpg', '.jpeg', '.png', '.gif', '.webp
import pandas as pd df = pd.read_excel('数据.xlsx') # 去重df.drop_duplicates(subset=['手机号'], keep='first').to_excel('去重后.xlsx&
import smtplibfrom email.message import EmailMessage def send_mail(to_list, subject, body, attachment=None): msg = EmailMessage() msg['From'] = &#
import time
from plyer import notification
def pomodoro(minutes=25):
print(f"专注 {minutes} 分钟,开始!")
time.sleep(minutes * 60)
notification.notify
import os
from PIL import Image
folder = './图片'
size = (800, 800) # 目标尺寸
for f in os.listdir(folder):
if f.lower().endswith(('.jpg',
from pypdf import PdfWriter, PdfReader
# 合并
writer = PdfWriter()
for pdf in ['a.pdf', 'b.pdf', 'c.pdf']:
writer.append(pdf)
write
import os
from docx import Document
folder = './文档'
for f in os.listdir(folder):
if f.endswith('.docx'):
doc = Document(os.path.j
import pandas as pd
df = pd.read_excel('总表.xlsx')
for name, group in df.groupby('部门'):
group.to_excel(f'拆分_{name}.xlsx', inde
import pandas as pd
import glob
files = glob.glob('./表格/*.xlsx')
df_list = [pd.read_excel(f) for f in files]
merged = pd.concat(df_list, ignore_index
import os
def batch_rename(folder, prefix='file_', start=1):
files = sorted([f for f in os.listdir(folder) if os.path.isfile(os.path.join(folder, f
import os def split_file(input_file, lines_per_file=2000, output_dir='output'): """ 将 input_file 按每 lines_per_file 行分割成多个文件,保存到 outpu