为什么做 DocBig
中文用户经常遇到难复制的扫描件、需要重新排序的 PDF、要交给知识库或 AI 使用的文档,以及临时的 PDF / Word 转换需求。很多简单任务不需要上传服务器,也不应该强迫用户注册。
DocBig 的目标是把这些高频任务做成解释清楚、结果可下载、文件去向透明的小工具。
当前提供的工具
PDF 页面处理
图片与 PDF 互转,以及 PDF 合并、压缩、拆分、提取、删除、旋转、缩略图查看和拖拽重排。
OCR 与扫描件
照片转扫描件、图片转文字、图片转 Word,以及扫描 PDF 转文字或 Markdown。
PDF 与 Word 转换
文本型 PDF 转 Word、Word 转 PDF,以及 PDF 转 TXT;Beta 工具会明确提示版式限制。
Markdown 与结构化文本
在 Markdown、Word、PDF、TXT 和 HTML 之间整理内容,适合笔记、知识库和 AI 工作流。
产品原则
- 文件去向透明:页面明确写清本地处理还是服务器处理;
- 中文优先:优先验证中文文件名、中文 OCR 和中文文档常见问题;
- 不过度承诺:Beta、复杂版式、浏览器和设备限制必须公开;
- 少收集数据:不采集文件正文、文件名、OCR 或转换结果;
- 先解决真实任务:根据使用和失败情况决定后续功能,而不是堆积工具数量。
当前边界
DocBig 不是桌面排版软件、云盘或法律存证服务。OCR 不承诺手写和复杂表格识别;PDF 与 Word 的 Beta 转换不承诺复杂版式保真;移动端大文件处理会受到设备内存和后台策略影响。
后续方向
当前优先完善兼容性记录、公开说明、固定样本回归和每个工具的帮助内容。任何服务器增强功能都需要独立评审,并在用户主动选择上传前说明用途、保留时间和删除规则。