# desktop_tool **Repository Path**: dailycreatebug/desktop_tool ## Basic Information - **Project Name**: desktop_tool - **Description**: No description available - **Primary Language**: Unknown - **License**: Not specified - **Default Branch**: master - **Homepage**: None - **GVP Project**: No ## Statistics - **Stars**: 1 - **Forks**: 1 - **Created**: 2026-09-21 - **Last Updated**: 2026-09-28 ## Categories & Tags **Categories**: Uncategorized **Tags**: None ## README # 小工具集合 (toolbox) 个人桌面小工具集:一个功能一个模块,逐步迭代。 ## 目录结构 ``` tool/ ├── toolbox/ # Python 包(所有工具的代码都在这里) │ ├── common/ # 各工具共用的基础设施(ffmpeg 查找、下载目录定位、工具插件契约等) │ ├── transcribe_audio/ # 工具①:音视频转文字 │ ├── extract_audio/ # 工具②:从音视频提取音频 │ ├── simplify_chinese/ # 工具③:繁体转简体 │ ├── md_to_docx/ # 工具④:Markdown 转 Word │ └── ui/ # 图形界面:自动发现所有工具,一个窗口全管 ├── 工具箱.bat / 工具箱.command # 双击打开图形界面(Win / macOS) ├── 转文字.bat # 把音视频文件拖到这个图标上即可转文字(命令行方式) ├── 提取音频.bat # 把音视频文件拖到这个图标上即可导出 mp3(命令行方式) ├── 繁转简.bat # 把文本文件拖到这个图标上即可繁转简(命令行方式) ├── md转word.bat # 把 markdown 文件拖到这个图标上即可转 Word(命令行方式) ├── setup.bat # 首次使用前双击一次,安装依赖 ├── requirements.txt # Python 依赖清单 └── README.md ``` ## 图形界面(推荐) **双击 `工具箱.bat`(Windows)或 `工具箱.command`(macOS)**,或命令行 `python -m toolbox.ui`。 窗口里选功能、添加文件(可多选)、点"开始",逐个文件显示处理状态,完成后可一键打开输出文件夹。界面里的功能列表是自动发现的,新增工具会自动出现。各工具的命令行/拖 bat 用法依然可用。 ## 现有工具 ### ① 转文字 (transcribe_audio) 把音频/视频里的语音识别成文字,输出 `.txt`(全文)和 `.srt`(带时间戳的字幕)。 - 模型:阿里 FunASR(Paraformer 中文模型 + VAD 静音检测 + 标点恢复) - **全程本地运行,内容不上传**,不需要联网(仅首次运行下载模型约 1GB,缓存在 `~/.cache/modelscope`,之后离线可用) - 支持常见格式:mp4 / mkv / mov / mp3 / wav / m4a … **使用方法(推荐):** 1. 双击 `setup.bat` 安装依赖(仅首次需要,约 1GB,装一次以后不用再装) 2. 把视频/音频文件**拖到 `转文字.bat` 图标上**松手,即自动开始 3. 结果统一保存到**系统"下载"文件夹**:同名 `.txt` 和 `.srt` (Windows 上会自动识别被 OneDrive 重定向过的下载目录;Mac 上是 `~/Downloads`) **命令行方式:** ``` python -m toolbox.transcribe_audio "某视频.mp4" python -m toolbox.transcribe_audio "某视频.mp4" -o D:\其他输出目录 python -m toolbox.transcribe_audio 文件1.mp4 文件2.mp3 # 支持一次转多个 ``` **速度参考:** 纯 CPU 下大约是音频时长的 1/4 ~ 1/2(如 1 小时的视频约需 15~30 分钟)。 ### ② 提取音频 (extract_audio) 把音频/视频里的声音提取出来,输出同名 `.mp3`(192k),不跑语音识别、不需要模型,速度快。 - 转成通用 mp3,任何播放器都能放;声道数和采样率保持原样 - 依赖 ffmpeg(`setup.bat` 装的 imageio-ffmpeg 就带,无需额外安装) **使用方法:** 把视频/音频文件**拖到 `提取音频.bat` 图标上**松手即可,结果保存到系统"下载"文件夹。 **命令行方式:** ``` python -m toolbox.extract_audio "某视频.mp4" python -m toolbox.extract_audio "某视频.mp4" -o D:\其他输出目录 python -m toolbox.extract_audio 文件1.mp4 文件2.mkv # 支持一次提多个 ``` ### ③ 繁转简 (simplify_chinese) 把纯文本文件里的**繁体字批量转成简体**,输出同名简体文件,不动原件。 - 支持 txt / markdown / srt / csv / json / yaml / html 等纯文本格式(完整清单见工具内 `TEXT_EXTS`) - 自动识别 **UTF-8 / Big5 / GBK** 编码(港台繁体文件常是 Big5,也能直接转) - OpenCC 字级转换,只改字形不改词汇;已是简体的文件自动跳过 - 依赖 `opencc-python-reimplemented`(`setup.bat` / `pip install -r requirements.txt` 会装上) **使用方法:** 图形界面里选"繁体转简体"加文件即可;或把文件拖到 `繁转简.bat` 上;或: ``` python -m toolbox.simplify_chinese "笔记.md" "字幕.srt" python -m toolbox.simplify_chinese 文件夹里所有.txt # 支持一次转多个 ``` ### ④ Markdown 转 Word (md_to_docx) 把 `.md` / `.markdown` 文件转成 **Word 文档(同名 .docx)**,适合把笔记交付给用 Word 的同事。 - 标题映射为 Word 大纲级别(可在 Word 里直接生成目录/导航窗格跳转),表格、代码块、引用、加粗斜体都保留 - 基于 pandoc(`pypandoc-binary` 自带转换器,pip 装好即用),全程本地 **使用方法:** 图形界面里选"Markdown → Word"加文件即可;或把文件拖到 `md转word.bat` 上;或: ``` python -m toolbox.md_to_docx "周报.md" python -m toolbox.md_to_docx 文件1.md 文件2.md # 支持一次转多个 ``` ## 如何新增一个工具 1. 在 `toolbox/` 下新建子包,如 `toolbox/新功能/`,里面放: - `__init__.py`:暴露 `TOOL = ToolInfo(...)`(从 `toolbox.common.tools` 导入),声明 key/title/desc 和 `run(源文件, 输出目录, on_status)`——**图形界面靠自动发现收录它,界面代码不用改** - `__main__.py`(命令行入口,用 argparse 解析参数,可选) - `core.py`(核心逻辑;耗时阶段调用 `on_status("…")` 汇报进度) 2. 多个工具都会用到的能力(如 ffmpeg 调用、下载目录定位 `get_downloads_dir()`)放进 `toolbox/common/`,不要复制粘贴 3. 想要拖拽用法的话,在根目录新建一个 `启动.bat`,照抄 `转文字.bat` 的三行结构,把模块名换掉