当前位置:首页>python>《别再一张张抠公章了!Python调用阿里qwen-image大模型,一键抠出所有公章,告别PS加班,效率提升100倍!》

《别再一张张抠公章了!Python调用阿里qwen-image大模型,一键抠出所有公章,告别PS加班,效率提升100倍!》

  • 2026-09-02 20:29:56
《别再一张张抠公章了!Python调用阿里qwen-image大模型,一键抠出所有公章,告别PS加班,效率提升100倍!》

“带你横跨办公自动化的数据江海”

@摸鱼

闻道有先后,术业有专攻。各位大佬们大家好!今又除夕,这里祝各位大佬 除夕之夜,辞旧迎新。愿旧梦如愿以偿,愿新梦顺势而生~,我依旧是你们的老朋友摸鱼~,本人在十多年的日常工作中摸爬滚打攒了不少Python办公自动化的实用项目技巧,自创立"码海听潮"公众号以来,已经陆续分享近80篇原创干货文章啦!里面满满的办公实操干货,希望能与各位大佬共同探讨办公效率提升之道,实现不加班自由。

好叻,多了不说,少了不唠,咱直接上干货。

办公需求场景

从崩溃到优雅的进化

有一个神秘的图片文件夹、里面有多张带公章的图片,现在的需求是要对所有图片里的公章进行抠图后单独保存,要是这种类似的需求你的Big Boss安排你去完成,请问阁下该如何应对?

需求的图片文件夹和水印图片列表如下图:

  • 带公章的图片文件夹

  • 带公章的图片

办公痛点分析

01

 痛点1:重复劳动多,效率极低

    • 单张处理耗时长:即便是熟练使用 Photoshop 的设计师,要精细地抠出一个公章(尤其是带有复杂背景、透明胶片底纹或红色印泥边缘的),少则需要 1-2 分钟,多则需要 5 分钟以上。

    • 数量累积效应:当图片文件夹里有几十张甚至上百张图片时,人工一张张抠图会变成一项机械且漫长的重复劳动,严重占用人力资源。

    02

     痛点2: 抠图质量难以保证(一致性差)

      • 边缘处理不一:公章边缘往往带有锯齿、印泥渗透的渐变或者不均匀的油墨。人工抠图时,不同的人或者同一个人在不同时间段的操作,对边缘的处理(如羽化、硬边处理)很难做到完全一致。

      • 色彩保留差异:公章的红色(通常是专色红)在不同背景(白纸、红头文件、彩色背景)上呈现的光学效果不同。人工调整色差时,主观性太强,导致抠出的公章颜色深浅不一。

      • 遗漏细节:公章中的五角星、最细微的文字笔画(如1-2毫米的小字)在人工用魔棒或钢笔工具抠图时很容易被误删或变残缺。

      由此可见若操作成百上千张带公章的图片的话整个操作流程繁琐且耗时,高频次的鼠标点击和键盘输入使操作者手指疲劳,堪称"键盘敲冒烟"式的体力劳动,加上人工疲劳操作极易导致遗漏文件夹。于是乎这时候,按以往的 “解题套路”,Python 的专属 BGM 该响起来了 ——go~ go~ go~,救苦救难的大救星这不就来了!!

      @摸鱼

      问题拆解思路

      1.遍历图片文件夹→

      2.调用阿里qwen-image-edit-max大模型api扣取图片公章→

      3.保存扣取公章的图片

      下面,我就用python代码让excel见识一下,什么叫"传统文化遇上赛博效率"(仅展示部分代码,非完整代码,需完整代码看文章末尾说明~)

      import sysimport osimport jsonfrom pathlib import Pathfrom PyQt6.QtWidgets import (    QApplication, QMainWindow, QWidget, QVBoxLayout, QHBoxLayout,    QPushButton, QLabel, QFileDialog, QTextEdit, QProgressBar,    QGroupBox, QMessageBox, QLineEdit, QGridLayout)from PyQt6.QtCore import Qt, QThread, pyqtSignalfrom PyQt6.QtGui import QFont# --- 配置文件路径 ---CONFIG_FILE = "watermark_remover_config.json"# --- 配置管理函数 ---def load_config():    """加载配置文件"""    default_config = {        "api_key": "",  # 默认API Key        "output_dir": "output",        "last_folder": "",  # 上次选择的文件夹路径    }    if os.path.exists(CONFIG_FILE):        try:            with open(CONFIG_FILE, 'r', encoding='utf-8') as f:                config = json.load(f)                # 确保所有必要的键都存在                for key in default_config:                    if key not in config:                        config[key] = default_config[key]                return config        except Exception as e:            print(f"读取配置文件失败: {str(e)},使用默认配置")            return default_config    else:        return default_configdef save_config(config):    """保存配置文件"""    try:        with open(CONFIG_FILE, 'w', encoding='utf-8') as f:            json.dump(config, f, ensure_ascii=False, indent=2)        return True    except Exception as e:        print(f"保存配置文件失败: {str(e)}")        return False# --- 工作线程类(仅保留框架,移除业务逻辑)---class WatermarkRemovalWorker(QThread):    """公章抠图工作线程(框架)"""    progress_signal = pyqtSignal(str)    progress_value_signal = pyqtSignal(int)    result_signal = pyqtSignal(dict)    error_signal = pyqtSignal(str)    def __init__(self, image_paths, api_key, prompt_text):        super().__init__()        self.image_paths = image_paths        self.api_key = api_key        self.prompt_text = prompt_text        self.running = True    def run(self):        """线程执行函数(模拟处理过程)"""        total_images = len(self.image_paths)        for idx, image_path in enumerate(self.image_paths):            if not self.running:                break            # 模拟处理进度            progress_value = int(((idx + 1) / total_images) * 100)            self.progress_value_signal.emit(progress_value)            # 模拟处理消息            self.progress_signal.emit(f"正在处理第 {idx + 1}/{len(self.image_paths)} 张图片: {os.path.basename(image_path)}")            # 模拟处理延迟            self.msleep(500)            # 模拟处理结果            result = {                'success': True,                'original_file': image_path,                'processed_files': [f"output/{os.path.basename(image_path)}"],                'original_size': "1920x1080",                'file_size': "2.5MB",                'new_size': "1024x1024"            }            self.result_signal.emit(result)            # 模拟错误(可选)            # if idx == 2:            #     self.error_signal.emit(f"处理图片 {os.path.basename(image_path)} 时出错: 模拟错误")        self.progress_signal.emit("处理完成!")    def stop(self):        """停止线程"""        self.running = False# --- 主界面类 ---class WatermarkRemovalApp(QMainWindow):    """公章抠图应用主窗口"""    def __init__(self):        super().__init__()        self.image_files = []        self.worker = None        self.current_image_index = 0        # 加载配置        self.config = load_config()        self.api_key = self.config.get("api_key", "")        self.init_ui()    def init_ui(self):        """初始化UI"""        self.setWindowTitle("公章抠图工具(界面框架)")        self.setGeometry(100, 100, 800, 700)        # 设置样式        self.setStyleSheet("""            QMainWindow {                background-color: #f0f2f5;            }            QGroupBox {                font-size: 14px;                font-weight: bold;                border: 2px solid #d1d9e6;                border-radius: 8px;                margin-top: 10px;                padding-top: 10px;                background-color: white;            }            QGroupBox::title {                subcontrol-origin: margin;                left: 10px;                padding: 0 5px 0 5px;                color: #2c3e50;            }            QPushButton {                font-size: 14px;                padding: 10px 20px;                border-radius: 6px;                border: none;                font-weight: bold;            }            QPushButton:hover {                opacity: 0.9;            }            QPushButton:disabled {                background-color: #bdc3c7;            }#startButton {                background-color: #2ecc71;                color: white;                font-size: 16px;                padding: 15px 30px;            }#folderButton {                background-color: #3498db;                color: white;            }#saveKeyButton {                background-color: #9b59b6;                color: white;                padding: 10px 15px;                min-width: 120px;            }            QLabel {                font-size: 14px;            }            QLineEdit {                font-size: 14px;                padding: 10px;                border: 1px solid #d1d9e6;                border-radius: 6px;                background-color: white;            }            QTextEdit {                border: 1px solid #d1d9e6;                border-radius: 6px;                padding: 8px;                font-size: 13px;                background-color: white;            }            QProgressBar {                border: 1px solid #d1d9e6;                border-radius: 6px;                text-align: center;                background-color: white;                font-weight: bold;            }            QProgressBar::chunk {                background-color: #3498db;                border-radius: 6px;            }        """)        # 创建中心部件        central_widget = QWidget()        self.setCentralWidget(central_widget)        main_layout = QVBoxLayout(central_widget)        main_layout.setSpacing(15)        main_layout.setContentsMargins(15, 15, 15, 15)        # API设置组        api_group = QGroupBox("API设置")        api_layout = QVBoxLayout()        # API Key输入框和保存按钮(水平布局)        api_key_layout = QHBoxLayout()        api_key_label = QLabel("API Key:")        self.api_key_edit = QLineEdit()        self.api_key_edit.setText(self.api_key)        self.api_key_edit.textChanged.connect(self.on_api_key_changed)        self.api_key_edit.setPlaceholderText("请输入您的API Key")        # 保存API Key按钮        save_key_button = QPushButton("💾 保存API Key")        save_key_button.setObjectName("saveKeyButton")        save_key_button.clicked.connect(self.save_api_key)        api_key_layout.addWidget(api_key_label)        api_key_layout.addWidget(self.api_key_edit)        api_key_layout.addWidget(save_key_button)        # 设置比例,让输入框占据更多空间        api_key_layout.setStretch(0, 1)        api_key_layout.setStretch(1, 4)        api_key_layout.setStretch(2, 1)        api_layout.addLayout(api_key_layout)        api_group.setLayout(api_layout)        main_layout.addWidget(api_group)        # 图片管理组        image_group = QGroupBox("图片管理")        image_layout = QVBoxLayout()        # 文件夹选择部分(使用网格布局)        folder_layout = QGridLayout()        folder_layout.setSpacing(10)        # 文件夹路径输入框        folder_label = QLabel("文件夹路径:")        self.folder_edit = QLineEdit()        self.folder_edit.setPlaceholderText("请选择或输入图片文件夹路径")        self.folder_edit.setText(self.config.get("last_folder", ""))        # 文件夹选择按钮        self.folder_button = QPushButton("📂 浏览文件夹")        self.folder_button.setObjectName("folderButton")        self.folder_button.clicked.connect(self.add_folder)        # 将控件添加到网格布局        folder_layout.addWidget(folder_label, 0, 0)        folder_layout.addWidget(self.folder_edit, 0, 1)        folder_layout.addWidget(self.folder_button, 0, 2)        # 设置列宽比例        folder_layout.setColumnStretch(0, 1)        folder_layout.setColumnStretch(1, 3)        folder_layout.setColumnStretch(2, 1)        # 添加到主布局        image_layout.addLayout(folder_layout)        image_group.setLayout(image_layout)        main_layout.addWidget(image_group)        # 提示词设置组        prompt_group = QGroupBox("提示词设置")        prompt_layout = QVBoxLayout()        prompt_label = QLabel("请输入提示词(描述需要如何处理图片):")        self.prompt_edit = QTextEdit()        default_prompt = "请仔细识别图片中的公章,确保:\n1. 对公章进行抠图\n2. 保持公章实际尺寸\n3. 去除背景文字\n4. 保持公章颜色一致"        self.prompt_edit.setText(default_prompt)        self.prompt_edit.setMinimumHeight(120)        prompt_layout.addWidget(prompt_label)        prompt_layout.addWidget(self.prompt_edit)        prompt_group.setLayout(prompt_layout)        main_layout.addWidget(prompt_group)        # 进度条        self.progress_bar = QProgressBar()        self.progress_bar.setTextVisible(True)        self.progress_bar.setFormat("%p%")        main_layout.addWidget(self.progress_bar)        # 开始按钮        self.start_button = QPushButton("🚀 开始处理(模拟)")        self.start_button.setObjectName("startButton")        self.start_button.clicked.connect(self.start_processing)        main_layout.addWidget(self.start_button)        # 日志显示        log_group = QGroupBox("处理日志")        log_layout = QVBoxLayout()        self.log_text = QTextEdit()        self.log_text.setReadOnly(True)        self.log_text.setMaximumHeight(200)        log_layout.addWidget(self.log_text)        log_group.setLayout(log_layout)        main_layout.addWidget(log_group)        main_layout.addStretch()    def add_folder(self):        """添加文件夹中的所有图片"""        current_path = self.folder_edit.text().strip()        if not os.path.exists(current_path):            current_path = self.config.get("last_folder", "")        folder = QFileDialog.getExistingDirectory(            self,            "选择图片文件夹",            current_path        )        if folder:            self.folder_edit.setText(folder)            self.config["last_folder"] = folder            save_config(self.config)            # 清空之前的图片列表            self.image_files.clear()            # 查找支持的图片文件            image_extensions = ['.png', '.jpg', '.jpeg', '.bmp', '.webp', '.gif']            image_files = []            for ext in image_extensions:                image_files.extend(list(Path(folder).glob(f'*{ext}')))                image_files.extend(list(Path(folder).glob(f'*{ext.upper()}')))            if image_files:                unique_files = list(set(image_files))                unique_files.sort()                self.image_files.extend([str(f) for f in unique_files])                self.log_message(f"从文件夹添加了 {len(unique_files)} 张图片")                self.log_message(f"文件夹: {folder}")            else:                QMessageBox.warning(self, "警告", "选择的文件夹中没有找到支持的图片文件")    def on_api_key_changed(self):        """API Key变化时更新"""        self.api_key = self.api_key_edit.text().strip()    def save_api_key(self):        """保存API Key到配置文件"""        self.api_key = self.api_key_edit.text().strip()        if not self.api_key:            QMessageBox.warning(self, "警告", "API Key不能为空!")            return        self.config["api_key"] = self.api_key        if save_config(self.config):            QMessageBox.information(self, "成功", "API Key已保存!")            self.log_message("API Key已保存到配置文件")        else:            QMessageBox.warning(self, "警告", "保存API Key失败")    def log_message(self, message):        """添加日志消息"""        import time        timestamp = time.strftime("%H:%M:%S", time.localtime())        self.log_text.append(f"[{timestamp}] {message}")        self.log_text.verticalScrollBar().setValue(            self.log_text.verticalScrollBar().maximum()        )    def start_processing(self):        """开始处理图片"""        if not self.image_files:            QMessageBox.warning(self, "警告", "请先选择要处理的图片文件夹!")            return        if not self.api_key:            QMessageBox.warning(self, "警告", "请输入API Key!")            return        current_prompt = self.prompt_edit.toPlainText().strip()        if not current_prompt:            QMessageBox.warning(self, "警告", "请输入提示词!")            return        self.progress_bar.setMaximum(100)        self.progress_bar.setValue(0)        self.current_image_index = 0        # 创建并启动工作线程        self.worker = WatermarkRemovalWorker(            self.image_files,            self.api_key,            current_prompt        )        # 连接信号        self.worker.progress_signal.connect(self.update_progress_message)        self.worker.progress_value_signal.connect(self.update_progress_value)        self.worker.result_signal.connect(self.on_processing_complete)        self.worker.error_signal.connect(self.on_processing_error)        self.worker.finished.connect(self.on_worker_finished)        # 更新UI状态        self.start_button.setEnabled(False)        # 开始处理        self.log_message(f"开始处理 {len(self.image_files)} 张图片...")        self.log_message(f"使用提示词:{current_prompt}")        self.worker.start()    def update_progress_message(self, message):        """更新进度消息"""        self.log_message(message)    def update_progress_value(self, value):        """更新进度条值"""        self.progress_bar.setValue(value)    def on_processing_complete(self, result):        """处理完成回调"""        original_file = result['original_file']        self.current_image_index += 1        message = f"✓ 完成处理: {os.path.basename(original_file)}"        if result['processed_files']:            message += f" -> {result['processed_files'][0]}"        self.log_message(message)    def on_processing_error(self, error_msg):        """处理错误回调"""        self.log_message(f"❌ 错误: {error_msg}")        self.current_image_index += 1    def on_worker_finished(self):        """工作线程完成"""        self.start_button.setEnabled(True)        self.progress_bar.setValue(100)        self.log_message("所有图片处理完成!")        # 询问是否打开结果文件夹        output_dir = self.config.get("output_dir", "output")        if os.path.exists(output_dir):            reply = QMessageBox.question(                self,                "处理完成",                "处理完成!是否打开结果文件夹?",                QMessageBox.StandardButton.Yes | QMessageBox.StandardButton.No            )            if reply == QMessageBox.StandardButton.Yes:                import subprocess                try:                    if sys.platform == "win32":                        os.startfile(output_dir)                    elif sys.platform == "darwin":                        subprocess.run(["open", output_dir])                    else:                        subprocess.run(["xdg-open", output_dir])                except Exception as e:                    self.log_message(f"无法打开文件夹: {str(e)}")    def closeEvent(self, event):        """关闭事件处理"""        # 保存当前API Key        current_api_key = self.api_key_edit.text().strip()        if current_api_key and current_api_key != self.config.get("api_key"):            self.config["api_key"] = current_api_key        # 保存当前文件夹路径        current_folder = self.folder_edit.text().strip()        if current_folder and current_folder != self.config.get("last_folder"):            self.config["last_folder"] = current_folder        save_config(self.config)        if self.worker and self.worker.isRunning():            reply = QMessageBox.question(                self,                "确认退出",                "处理正在进行中,确定要退出吗?",                QMessageBox.StandardButton.Yes | QMessageBox.StandardButton.No            )            if reply == QMessageBox.StandardButton.Yes:                self.worker.stop()                self.worker.wait()                event.accept()            else:                event.ignore()        else:            event.accept()# --- 主程序入口 ---def main():    app = QApplication(sys.argv)    app.setStyle('Fusion')    window = WatermarkRemovalApp()    window.show()    sys.exit(app.exec())if __name__ == "__main__":    main()

      最终将所有的图片的公章都成功扣取出来,完美实现了之前既定的需求...

      通过上面Python自动化脚本,仅用几分钟的时间就完成原需手动操作数小时甚至数天的工作任务。从最初准备手动人工机械操作的麻木到用python实现高效自动化的畅快,工作效率获得指数级提升,终于实现了不加班熬夜的自由!

      大佬们也可以举一反三,参照上面的代码思路根据自己工作中的实际情况来具体问题具体分析,实现自己定制化的需求。

      结语

      当Python遇见办公,牛马打工人终于笑出了猪叫声

      【职场人必看】每天早上一睁眼,想到又要面对:

      1.📊 堆积如山的Excel表格

      2.📑 机械重复的复制粘贴

      3.✍️ 永远改不完的各类文档

      4.诸如此类的更多........

      是不是连Ctrl+Alt+Delete的心都有了?

      别慌!别急,摸鱼这位“职场外挂”已经带着Python代码来拯救你了!

      友情提示:考虑到没有python环境的朋友需要打包好的成品exe,摸鱼早已贴心打包好,本篇文章代码打包的exe截图如下:

      另外,《码海听潮》公众号所有文章码和exe程序已打包好上传绿联nas私有云,有需要的大佬扫一扫上面博主的个人微信二维码,需要的大佬需支付9.9元永久拥有公众号资源(写原创干货费时费力,属实不易),邀请您进入社区群获取下载链接!!,群内提供python办公自动化交流问题,解决问题,且码海听潮微信公众号文章发布会第一时间会更新到群里,非诚勿扰哈!

      码海听潮官方社区群如下:

      赶紧微信扫一扫下方二维码添加摸鱼君微信

      最新文章

      随机文章