面向 Windows 开发者的本地优先磁盘资产治理助手。
DiskLint 希望像代码 Lint 工具检查“代码坏味道”一样,检查磁盘上的“文件坏味道”:长期无变化的项目、重复克隆、快速增长的构建产物、占用巨大的虚拟机磁盘,以及不敢贸然处理的个人代码。
它不只回答“哪个文件最大”,还尝试回答:
- 这些空间属于哪个项目、仓库或虚拟机?
- 哪些内容可以重新生成、下载或克隆?
- 哪些内容包含本地独有修改,必须优先保护?
- 如果需要释放指定空间,应该先处理哪些低风险对象?
项目目前处于需求梳理与产品设计阶段,尚未开始编码,也没有可供下载的版本。
- 产品需求文档(PRD v0.1)
- 下一阶段:采集可行性原型和脱敏测试集
- 定期采集磁盘文件元数据并保留历史快照。
- 把文件聚合为 Git 仓库、个人代码、开源收藏、虚拟机、构建产物和缓存等资产。
- 发现新增大对象、快速增长目录和长期无观察变化的疑似闲置资产。
- 检查 Git 工作区、未跟踪内容、本地独有提交和可重建目录。
- 盘点虚拟磁盘、快照、差分盘和 ISO,并对无法验证的关系保持高风险提示。
- 按证据、风险、预计收益和恢复方式生成整理建议。
- 可选调用 OpenAI 等大模型生成解释、排序和报告。
DiskLint 不绑定单一磁盘工具,计划采用可插拔采集器:
| 数据源 | 定位 |
|---|---|
| Everything | MVP 首选高速元数据源,通过 ES.exe 定时读取已有索引 |
| WizTree | 支持 CSV/TSV 导入;自动调用取决于部署方式和许可确认 |
| 原生扫描器 | 后续作为第三方工具不可用时的后备方案 |
| Git / VM 适配器 | 读取结构化状态,补充普通文件扫描无法理解的语义 |
DiskLint 的首版不是“一键清理器”。
- 默认只读,不自动删除、移动、压缩或修改用户文件。
- 本地规则负责事实、证据、风险和空间计算。
- 大模型只负责归纳、解释和排序,不能绕过保护规则或降低风险等级。
- 云端 AI 默认关闭;启用后默认只发送聚合和脱敏数据。
- 不建立源码或文档正文索引,不把正文发送给模型。
- Git 本地独有状态、个人代码和无法验证关系的虚拟磁盘采用保守策略。
flowchart LR
A["文件元数据采集"] --> B["本地快照与差异"]
B --> C["资产聚合"]
C --> D["规则与风险分析"]
D --> E["候选建议与证据"]
E --> F["可选 AI 解释"]
E --> G["用户审查"]
F --> G
- 验证 Everything/WizTree 导出、百万级导入和快照差异。
- 实现只读盘点、Git/VM 基础分类和本地规则建议。
- 接入可选的结构化 AI 分析和隐私预览。
- 增加专用虚拟化平台适配器、远端仓库验证和本地模型。
- 在分类准确率和用户信任建立后,再评估隔离、撤销和受控执行。
项目仍处于早期阶段,欢迎通过 GitHub Issues 提交使用场景、数据源需求、隐私顾虑和安全边界建议。
尤其希望了解:
- 你主要使用 Everything 还是 WizTree?
- 你使用 Hyper-V、VMware、VirtualBox 还是 WSL2?
- 个人代码与开源收藏在你的磁盘上如何区分?
- 你能接受云端模型看到哪些级别的脱敏元数据?