你的收藏夹已经烂掉了:一次彻底清理的方法

打开你的浏览器收藏夹,看一眼有多少条。再问自己一个问题:上个月点开过其中几条?

对多数人来说,这两个数字差了两个数量级。收藏夹早就不是「我要用的东西」,而是「我以为将来会用的东西」的堆填区。

问题不只是乱。链接会腐烂——服务关停、被收购后域名重定向到集团首页、路径改版。几年下来,相当一部分收藏会静默失效,你不点开根本不知道。

这篇给一套能在一小时内做完的清理流程。

为什么「以后再整理」永远不会发生

因为收藏这个动作的成本是零,而整理的成本不是。

按下 Ctrl+D 只需要半秒,而且它给你一种「这件事已经处理了」的错觉——实际上你只是把它推迟了。心理上收藏等于阅读,行为上收藏等于遗忘。

所以清理不能靠「以后慢慢来」,必须是一次性的、有明确规则的、限时完成的动作。

第一步:导出

先把现状固定下来。Chrome、Edge、Firefox 都支持导出书签为 HTML 文件(书签管理器 → 右上角菜单 → 导出)。

导出的意义有两个:一是万一删错了能找回来,二是接下来的批量检测需要这个文件。

导出完,把这份文件另存一份,标上日期。这是你的还原点。

第二步:批量检死链

手动一条条点开是不现实的。用一段脚本跑一遍,几分钟就能出结果。

如果你机器上有 Node,把导出的 HTML 放在同一个目录,存下面这段为 check.js,然后 node check.js bookmarks.html

const fs = require('fs');
const https = require('https');
const http = require('http');

const file = process.argv[2];
const html = fs.readFileSync(file, 'utf8');
const urls = [...html.matchAll(/HREF="(https?:\/\/[^"]+)"/gi)].map(m => m[1]);
const uniq = [...new Set(urls)];
console.log('共 ' + uniq.length + ' 个链接,开始检查...');

let idx = 0, dead = [];
function check(url) {
  return new Promise(resolve => {
    const lib = url.startsWith('https') ? https : http;
    const req = lib.request(url, { method: 'HEAD', timeout: 10000 }, res => {
      res.resume();
      resolve(res.statusCode);
    });
    req.on('timeout', () => { req.destroy(); resolve(0); });
    req.on('error', () => resolve(0));
    req.end();
  });
}

(async () => {
  await Promise.all(Array.from({ length: 8 }, async () => {    while (idx < uniq.length) {
      const u = uniq[idx++];
      const code = await check(u);
      if (code === 0 || code === 404 || code === 410 || code >= 500) dead.push(code + '  ' + u);
    }
  }));
  console.log('\n疑似失效 ' + dead.length + ' 条:');
  dead.forEach(d => console.log('  ' + d));
})();

跑完你会得到一份疑似失效清单。注意 403 不一定是死链——很多站点会拒绝自动化请求,所以脚本里没把它算进去;如果想更严格,可以自己加上再人工确认。

失效的直接删,不要留着「说不定以后能恢复」。

第三步:按规则删,不要凭感觉

删剩下的部分才是重点。凭感觉删的结果是一条都删不掉,所以要用硬规则。逐条过一遍,符合任何一条就删:

规则一:一年没点开过的,删。 浏览器的书签管理器不显示访问时间,但你自己知道。犹豫超过三秒的,就是没在用。

规则二:写不出一句话说明它是干什么的,删。 这条最有效。如果你连它为什么被收藏都想不起来,它对你就是零价值。

规则三:搜索一秒能找到的,删。 「知乎」「淘宝」「B站」这类,收藏它们纯属仪式感。地址栏输两个字母就到了。

规则四:同类的只留一个。 五个在线 PDF 转换工具,你实际只会用第一个。留最好用的那个,其余删掉。

规则五:为了「以后学」收藏的教程,删。 这是收藏夹里占比最高、点开率最低的一类。真要学的时候你会重新搜,而且会搜到更新的版本。

第四步:按「什么时候会用」重新分类

清理完剩下的,通常不到原来的四分之一。这时候重建结构。

关键原则:按使用场景分,不按网站类型分。

多数人的分类是「工具类」「学习类」「购物类」——但你找东西的时候想的不是「这是个工具」,而是「我现在要做一件事」。所以更好的分法是:

  • 每天开(放书签栏,不超过 8 个)
  • 工作时开(按项目或职能分,比如「写文档时」「做设计时」)
  • 偶尔查(放二级文件夹,容忍它大一点)
  • 待读(这个文件夹要设过期规则,见下)

「待读」是最容易再次失控的地方。给它定一条规则:超过一个月没读的,直接删。 一个月都没动,说明它没那么重要。

三条防止再次失控的规则

清理是一次性的,不失控是长期的。

上限一百条。 给自己定个数字,超了就必须删一条才能加一条。约束会逼你判断。

收藏时写一句话。 浏览器允许改书签名称,把它从网页标题改成你自己的一句描述——「找免费图的」「查汇率的」。写不出来的,当场就不该收藏。

每半年复查一次。 设一个日历提醒。重复上面第二、三步,通常二十分钟就能做完。

一个更省事的替代方案

说实话,上面这一整套是有维护成本的。

对于通用的、大家都会用的站点——AI 工具、图库、翻译、网盘、流媒体——你完全没必要自己维护一份清单。这类东西的正确做法是用一个有人在持续更新、会做死链检查、每条都写了用途说明的导航站,收藏那一个入口就够了。

自己的收藏夹只留真正私人的部分:你的项目文档、你常用的内部系统、你正在追的那几个作者。这部分别人替你维护不了,也就那么二三十条。

这也是我做这个导航站的原因。收录标准和维护方法写在 《我是怎么筛选和维护这份网址列表的》 里,如果你想自己整理,那篇的方法可以直接缩小到个人使用。

一句话

收藏夹的价值在于能快速找到,不在于收了多少。删到你能一眼扫完为止,它才重新开始有用。

按用途分好类的站点列表在 本站首页,目前 17 个分类、222 个站点,每条都写了一句话说明。