查找没有扩展名的链接
我想分享一个我已经开始依赖的功能,因为它解决了一个曾经让我完全卡住的问题。
那些什么都说不出来的链接
大多数时候,网站上的文件很容易识别。链接以 .pdf 或 .jpg 或 .csv 结尾,任何像样的工具都能识别出来。Download All Files 会扫描页面,列出找到的内容,我只需点击几下就能下载所有文件。
但偶尔我会遇到一个遵循不同规则的页面。这些链接看起来像普通的网址,只是一条路径加上一串数字或字母,完全没有扩展名。末尾没有 .pdf,也看不出里面是什么。对于普通的下载工具来说,这些链接看起来像普通页面,不是值得下载的文件。所以它们被跳过了,我的列表返回为空,尽管我能清楚地看到屏幕上有文档。

为什么会这样
原因是一种叫做按需生成文件的东西。文档没有准备好在服务器上等待被找到。它是在你点击链接的那一刻才被创建的。在那之前,没有文件名或扩展名可供检测。链接更像是一个请求,说"为我创建这个文件",而不是指向已存在文件的指针。
这在账单门户、报告系统以及任何从数据库构建文档的网站上都很常见。这也正是批量下载最有帮助的情况,也正是大多数工具放弃的地方。
Deep Search 的解决方案
这就是 Deep Search 的用武之地。它不仅仅读取明显的文件链接,而是深入探索。你在页面上打开扩展程序,点击 Deep Search,它会检查每个链接,看是否有真实文件在后面等着。那些被证实是文档、图像或电子表格的链接会被加入你的列表,即使链接本身没有给出任何线索。
我还记得第一次尝试它的情景。我在一个那样的固执的门户网站上,看着那些我可以逐个打开但无法批量保存的文件。我运行了 Deep Search,等待了一会,就在那里,每个文件排队整齐,准备一起下载。那个原本会占用我整个下午的任务在不到一分钟内完成了。
安全,因为它留在你的电脑上
对我来说最重要的部分是它的工作原理。Deep Search 在本地运行,直接在我自己的机器上。没有任何东西被发送到外部服务器进行检查。当文件是私密的时候,而在我的工作中它们通常是私密的,这不是个小细节。我永远不想让敏感记录只是为了让工具弄清楚它们是什么而通过第三方。使用 Deep Search,我不必担心这个,而且由于扩展程序只在我打开它时才运行,没有任何后台活动在我的背后进行。
几句诚实的话
Deep Search 很彻底,所以它比普通扫描需要更长的时间。它必须逐一检查每个链接,考虑到它所做的工作,这是有道理的。在有许多链接的页面上,我会给它一段时间。对我来说,这种权衡很容易。短暂的等待比一小时的点击要好。
我也喜欢基础版是免费的,所以你可以在不支付任何费用的情况下尝试。
我不是在每个页面上都需要 Deep Search。普通扫描可以很好地处理大多数网站。但对于那些链接看起来像胡言乱语、什么也不显示的页面,这就是把我从困境中解救出来的功能。