在好例子网,分享、交流、成长!
您当前所在位置:首页Python 开发实例Python语言基础 → Python文本处理:正则表达式实战提取链接和邮箱

Python文本处理:正则表达式实战提取链接和邮箱

Python语言基础

下载此实例
  • 开发语言:Python
  • 实例大小:0.05M
  • 下载次数:0
  • 浏览次数:2
  • 发布时间:2026-08-29
  • 实例类别:Python语言基础
  • 发 布 人:用心做
  • 文件格式:.zip
  • 所需积分:2
 

实例介绍

运行效果

实例简介

使用 re 模块从文本中批量提取 URL 链接和邮箱地址,支持多种格式匹配。基于 Tkinter 的图形界面,输入文本后一键提取,结果清晰展示。

核心代码

import tkinter as tk
from tkinter import ttk, scrolledtext
import re
import platform

# 设置中文字体
CHINESE_FONT = "WenQuanYi Zen Hei" if platform.system() == "Linux" else "Microsoft YaHei"

class RegexExtractorApp:
    def __init__(self, root):
        self.root = root
        root.title("正则表达式提取工具")
        root.geometry("700x600")
        root.configure(bg="#f5f5f5")
        
        # 标题
        title_label = tk.Label(root, text="正则表达式实战:批量提取链接和邮箱", 
                              font=(CHINESE_FONT, 18, "bold"), bg="#f5f5f5", fg="#2c3e50")
        title_label.pack(pady=15)
        
        # 输入区域
        input_frame = tk.Frame(root, bg="#f5f5f5")
        input_frame.pack(padx=20, pady=10, fill="both", expand=True)
        
        tk.Label(input_frame, text="请输入待提取文本:", 
                font=(CHINESE_FONT, 12, "bold"), bg="#f5f5f5", fg="#34495e").pack(anchor="w", pady=5)
        
        self.text_input = scrolledtext.ScrolledText(input_frame, height=8, 
                                                     font=(CHINESE_FONT, 11), wrap=tk.WORD)
        self.text_input.pack(fill="both", expand=True, pady=5)
        
        # 示例文本
        sample_text = """联系我:test@example.com 或 admin@51python.com
访问网站:https://www.haolizi.com 和 http://blog.example.org
我的邮箱是 user.name@domain.cn,官网:https://api.mysite.com/v1
"""
        self.text_input.insert("1.0", sample_text)
        
        # 按钮区域
        btn_frame = tk.Frame(root, bg="#f5f5f5")
        btn_frame.pack(pady=10)
        
        extract_btn = tk.Button(btn_frame, text="提取链接和邮箱", 
                               font=(CHINESE_FONT, 12, "bold"),
                               bg="#3498db", fg="white", padx=20, pady=10,
                               command=self.extract_content, cursor="hand2")
        extract_btn.pack(side="left", padx=10)
        
        clear_btn = tk.Button(btn_frame, text="清空", 
                             font=(CHINESE_FONT, 12),
                             bg="#95a5a6", fg="white", padx=20, pady=10,
                             command=self.clear_results, cursor="hand2")
        clear_btn.pack(side="left", padx=10)
        
        # 结果区域
        result_frame = tk.Frame(root, bg="#f5f5f5")
        result_frame.pack(padx=20, pady=10, fill="both", expand=True)
        
        tk.Label(result_frame, text="提取结果:", 
                font=(CHINESE_FONT, 12, "bold"), bg="#f5f5f5", fg="#34495e").pack(anchor="w", pady=5)
        
        self.result_text = scrolledtext.ScrolledText(result_frame, height=6, 
                                                      font=(CHINESE_FONT, 11), wrap=tk.WORD,
                                                      bg="#ecf0f1")
        self.result_text.pack(fill="both", expand=True, pady=5)
        
        # 统计信息
        self.stats_label = tk.Label(root, text="等待提取...", 
                                   font=(CHINESE_FONT, 11), bg="#f5f5f5", fg="#7f8c8d")
        self.stats_label.pack(pady=10)
    
    def extract_content(self):
        """提取链接和邮箱"""
        text = self.text_input.get("1.0", tk.END)
        
        # 正则表达式
        url_pattern = r'https?://[^\s<>"]+|www\.[^\s<>"]+'
        email_pattern = r'[a-zA-Z0-9._%+-]+@[a-zA-Z0-9.-]+\.[a-zA-Z]{2,}'
        
        urls = re.findall(url_pattern, text)
        emails = re.findall(email_pattern, text)
        
        # 去重
        urls = list(dict.fromkeys(urls))
        emails = list(dict.fromkeys(emails))
        
        # 显示结果
        result = "【提取的链接】\n"
        for i, url in enumerate(urls, 1):
            result += f"{i}. {url}\n"
        
        result += "\n【提取的邮箱】\n"
        for i, email in enumerate(emails, 1):
            result += f"{i}. {email}\n"
        
        self.result_text.delete("1.0", tk.END)
        self.result_text.insert("1.0", result)
        
        # 更新统计
        self.stats_label.config(
            text=f"✅ 提取完成:找到 {len(urls)} 个链接,{len(emails)} 个邮箱",
            fg="#27ae60"
        )
    
    def clear_results(self):
        """清空结果"""
        self.result_text.delete("1.0", tk.END)
        self.stats_label.config(text="等待提取...", fg="#7f8c8d")

def create_gui():
    root = tk.Tk()
    app = RegexExtractorApp(root)
    root.mainloop()

if __name__ == "__main__":
    create_gui()

适用场景

数据清洗、信息采集、日志分析、文本处理

标签:

实例下载地址

Python文本处理:正则表达式实战提取链接和邮箱

不能下载?内容有错? 点击这里报错 + 投诉 + 提问

好例子网口号:伸出你的我的手 — 分享

网友评论

发表评论

(您的评论需要经过审核才能显示)

查看所有0条评论>>

小贴士

感谢您为本站写下的评论,您的评论对其它用户来说具有重要的参考价值,所以请认真填写。

  • 类似“顶”、“沙发”之类没有营养的文字,对勤劳贡献的楼主来说是令人沮丧的反馈信息。
  • 相信您也不想看到一排文字/表情墙,所以请不要反馈意义不大的重复字符,也请尽量不要纯表情的回复。
  • 提问之前请再仔细看一遍楼主的说明,或许是您遗漏了。
  • 请勿到处挖坑绊人、招贴广告。既占空间让人厌烦,又没人会搭理,于人于己都无利。

关于好例子网

本站旨在为广大IT学习爱好者提供一个非营利性互相学习交流分享平台。本站所有资源都可以被免费获取学习研究。本站资源来自网友分享,对搜索内容的合法性不具有预见性、识别性、控制性,仅供学习研究,请务必在下载后24小时内给予删除,不得用于其他任何用途,否则后果自负。基于互联网的特殊性,平台无法对用户传输的作品、信息、内容的权属或合法性、安全性、合规性、真实性、科学性、完整权、有效性等进行实质审查;无论平台是否已进行审查,用户均应自行承担因其传输的作品、信息、内容而可能或已经产生的侵权或权属纠纷等法律责任。本站所有资源不代表本站的观点或立场,基于网友分享,根据中国法律《信息网络传播权保护条例》第二十二与二十三条之规定,若资源存在侵权或相关问题请联系本站客服人员,点此联系我们。关于更多版权及免责申明参见 版权及免责申明

;
报警