文件夹与标签:构建可检索的文档库
Paper Scanner 在同一文档库内同时支持嵌套文件夹与多对多标签。两种模型回答不同问题,本文说明何时使用、如何配合,并在常见检索、归档等使用场景下给出具体组合建议。
Paper Scanner 的文档列表同时支持嵌套文件夹与多标签。两种模型并非冗余:文件夹回答”这份文档放在哪里”,标签回答”这份文档是什么”。两者配合使用,能让数百份文档的库无需手动搜索即可查找。
文件夹模型
文件夹构成树形结构,每份文档只属于一个文件夹。文件夹适合稳定、树状、每个文档一份的维度:
- 按时间归档(年 / 季 / 月)
- 按项目结构(客户 / 项目 / 阶段)
- 按物理位置(家 / 锅炉 / 说明书)
- 单一关系的账户和供应商
文件夹层级建议控制在四层以内。更深的嵌套通常意味着两个维度被塞进了同一棵树,会让检索变得脆弱。
标签模型
标签扁平且可叠加。一份文档可以挂任意多个标签。标签回答那些不属于单一文件夹的横切问题:
- 文档类型(
收据、合同、文档、保修单) - 处理状态(
待办、待审、待归档) - 时间段分组(
2024报税、2025报税) - 来源(
本机扫、导入)
标签视图会跨文件夹把所有匹配文档归集在一起。这是回答”上个季度所有收据”或”本周我扫过的全部内容”这类问题的主要机制。
推荐工作流程
- 直接扫入对应文件夹。 使用既有层级结构,扫描时不要新建文件夹。
- 为跨文件夹的文档打标签。 一份放在
2026 / Q2 / Acme / 合同里的文档,可以同时打待办和q2续约标签,以便续约季时跨所有客户检索。 - 定期清理标签视图。 集中处理那些匆忙扫进来的、还没归档的文档。
组合搜索同时支持文件夹与标签过滤,这是双模型并用的主要优势。
应当避免的模式
- 过度打标签。 每份文档两到三个标签是实际上限。更多标签会稀释含义、降低搜索精度。
- 把年份放进标签。 年份属于文件夹,因为年份构成天然的树。标签应描述”是什么”,而非”什么时候发生”。
- 文件夹嵌套过深。 四层是实际上限。超过四层时,将一个维度拆出作为标签。
- 随意重命名文件夹。 文件夹路径被分享链接、导出、同步等引用。除非必要不要改名;如需重新分类,优先使用标签。
什么情况下只用文件夹足够
文档数量在 100 份以内且分类明显时,标签会增加管理负担但收益有限。仅使用文件夹即可应对此类规模。当文档库增长到跨切面搜索成为常见需求时(通常约 200 份),再引入标签。
相关文章
云同步:将文档库镜像至自己的 Drive 或 iCloud
Paper Scanner 可将文档库镜像至用户自己的 Google Drive 或 iCloud 文件夹。本文说明功能范围、适用场景、配置步骤与恢复流程,并提供迁移指引。
本地 OCR:让每一页扫描都可搜索
Paper Scanner 使用 Apple 与 Google 设备端机器学习套件在本地完成 OCR,支持拉丁字母与中日韩文字。本文说明 OCR 能力、适用场景、准确率最佳实践与语言支持。
多页 PDF 合并导出与可选密码保护
Paper Scanner 的导出流程可将多页扫描合并为单一 PDF,并支持可选密码保护。本文介绍标准流程、合并与拆分取舍、密码设置与大批量处理,并给出配置建议。
免费版与 Pro:功能范围、定价与订阅机制
Paper Scanner Pro 解锁无限 OCR、去除横幅广告、加入后台自动云同步。本文说明各档位包含的内容、谁适合订阅、以及订阅到期后的处理方式,并给出选档建议。