文件夹与标签:组织可扫描的文档库
Paper Scan 的文档列表同时支持嵌套文件夹和多标签。两种模型并不冗余:文件夹回答"这份文档住在哪里",而标签回答"这份文档是什么"。结合使用,它们可以让几百份文档的库在无需手动搜索的情况下即可被找到。
文件夹模型
文件夹形成树形结构。每个文档恰好位于一个文件夹中。文件夹最适用于稳定、层级清晰、一份文档一个维度的场景:
- 基于时间的归档(年/季度/月)
- 项目结构(客户/项目/阶段)
- 物理位置(房屋/锅炉/手册)
- 单关系的账户和供应商
文件夹层级建议保持在四层或更少。更深的嵌套通常意味着两个维度被编码到同一棵树中,会让检索变得脆弱。
标签模型
标签是扁平和可累加的。一个文档可以携带任意数量的标签。标签回答不适合单个文件夹的横向问题:
- 文档类型(
receipt、contract、manual、warranty) - 操作状态(
urgent、to-review、to-file) - 时间段分组(
tax-2024、tax-2025) - 来源(
scanned-here、imported)
标签视图跨文件夹分组所有匹配的文档。这是回答"给我看上一季度的所有发票"或"我本周扫描的所有内容"等问题的核心机制。
推荐工作流
- 直接扫描到适当的文件夹。使用现有层级,而不是在扫描过程中创建新文件夹。
- 应用跨文件夹的标签。位于
2026 / Q2 / Acme / contracts的文档也可以携带urgent和q2-renewal,以便在续约时跨所有客户端检索。 - 定期扫描标签视图,归档匆忙扫描的文档。
组合搜索支持文件夹和标签过滤器一起使用,这是同时使用两种模型的主要优势。
应避免的模式
- 过度打标签。 每份文档 2 到 3 个标签是实际限制。更多标签会稀释其含义并降低搜索精度。
- 年份在标签中。 年份属于文件夹,因为它们形成自然树。标签应描述"文档是什么",而非"何时发生"。
- 深层文件夹嵌套。 四层是实际上限。超过这个深度,将一个维度拆出为标签。
- 重命名文件夹。 文件夹路径被分享链接、链接和同步引用。仅在必要时重命名;重新分类优先用标签。
对于少于 100 份且归类明显的文档,单独的文件夹就足够了,直到库增长到横向搜索变得常见——通常在 200 份文档左右。