它解决什么问题
把本地文档转成 Markdown,很多时候你只想要「快」——拖进来、出结果、拿走。AnyDoc 就是为这个场景做的:
- 一份 Word 报告 → 毫秒级出 Markdown,丢进知识库或 AI;
- 一个 Excel / CSV 表格 → 转成 Markdown 表格,贴进文档;
- 一本 EPUB 电子书 / 一份 PPT → 提取正文,整理成笔记。
因为底层是 Rust 原生转换器、依赖极轻,它比「啥格式都装」的方案更快、更省资源。
核心特性
- 毫秒级转换:Rust 原生转换器,文档拖进来几乎瞬间出结果;
- 依赖极轻:没有笨重的运行时依赖,安装和启动都快;
- 命令行 + 图形界面:双击拖文件即转,或终端里批量处理;
- 拖放即转:文件拖进窗口松开,自动转换;
- 格式够用:覆盖办公场景最常见的文档格式(见下);
- 轻量安装:安装包约 0.6MB,免管理员、自动加入 PATH 与开始菜单。
支持的格式
常见输入格式:
.doc · .docx · .odt · .pdf · .ppt · .pptx · .rtf · .epub · .xlsx · .ods · .odp · .csv(以及 .docm / .xlsm / .ppsx / .xls / .xlsb 等容器变体)。
图形界面(GUI)怎么用
装完后双击桌面或开始菜单的 AnyDoc 图标即可打开,没有命令行黑窗口。界面要点:
- 拖放转换:文件拖进窗口松开即转,最省事;
- 输入来源:填本地文件路径;
- 输出文件:留空只预览,填了路径就保存成
.md; - 暗色 / 亮色主题:标题栏 ⚙ 设置里切换;
- 无边框窗口:拖标题栏移动、拖边缘缩放、双击标题栏最大化。
命令行(CLI)速查
新开一个终端,命令是 py-tools-anydoc:
:: 把 Word 文档转成 Markdown,结果输出到屏幕
py-tools-anydoc 报告.docx
:: 输出到指定文件
py-tools-anydoc 表格.xlsx -o 表格.md
:: 详细日志
py-tools-anydoc -v 报告.pdf
:: 查看完整帮助
py-tools-anydoc --help
| 参数 | 命令行选项 | 说明 |
|---|---|---|
| 输入来源 | SOURCE(位置参数) | 本地文件路径(不支持 URL) |
| 输出文件 | -o, --output | 留空只预览 |
| 详细日志 | -v, --verbose | 输出详细日志 |
两个明确的边界
为了让它又快又轻,AnyDoc 有意不做两件事:
- 不支持 OCR:能直接提取「文字型」PDF / 文档里的文字;但扫描版、纯图片型 PDF本质是图片,需要 OCR 才能拿到文字——这部分请用 MarkItDown 接 Azure Document Intelligence。
- 不支持网页 URL:只认本地文件路径。要把网页转 Markdown,同样推荐 MarkItDown。
所以定位很清楚:本地文档、追求轻快 → AnyDoc;要网页 / OCR / 格式最全 → MarkItDown。两者可同时安装。
下载与安装
- 点上方「下载安装包」按钮,得到
py-tools-anydoc-setup-1.0.0.exe; - 双击运行,按提示下一步——免管理员,装到当前用户目录,自动加入开始菜单和 PATH;
- 想用图形界面:双击桌面或开始菜单的 AnyDoc 图标;
- 想用命令行:新开终端输入
py-tools-anydoc。
首次启动会在窗口里显示环境初始化进度(约 1~3 分钟),完成后即可使用。本系列三个工具共用一套运行环境,之后装另外两个会很快。
常见问题
- 扫描版 PDF 转不了?纯文字 PDF 可直接转换;扫描件 / 纯图片 PDF 需要 OCR,AnyDoc 不支持,请改用 MarkItDown + Document Intelligence。
- 报「文档已加密或受密码保护」?去掉文件密码后重试。
- 图形界面打不开?依赖系统 WebView2 运行时(Win10 / Win11 通常自带)。
- 能转网页吗?不能,只认本地文件。转网页用 MarkItDown。
总结
如果你手上大多是本地文档,想要又快又轻的转换体验——不装一堆用不上的格式依赖、拖进来就出结果——AnyDoc 是最顺手的选择。免费、毫秒级、装上不占地方。