惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园_首页
博客园 - Franky
大猫的无限游戏
大猫的无限游戏
博客园 - 三生石上(FineUI控件)
量子位
博客园 - 聂微东
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
S
SegmentFault 最新的问题
Apple Machine Learning Research
Apple Machine Learning Research
爱范儿
爱范儿
V
Visual Studio Blog
雷峰网
雷峰网
T
Tailwind CSS Blog
宝玉的分享
宝玉的分享
Blog — PlanetScale
Blog — PlanetScale
有赞技术团队
有赞技术团队
博客园 - 叶小钗
Microsoft Azure Blog
Microsoft Azure Blog
T
The Blog of Author Tim Ferriss
U
Unit 42
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
小众软件
小众软件
阮一峰的网络日志
阮一峰的网络日志
Y
Y Combinator Blog

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
Week 11:学会扒网页 - 少数派
2019-01-04 · via 少数派

在我的印象里,让 Workflow 这款应用「出圈儿」,同时也为捷径招徕最多赞誉和不屑的,就是那一套下载社交网站视频/图片的 Workflow。

出圈儿和招徕赞誉当然是因为从前在 iOS 上无处下手的视频/图片下载,从此成为可能。微博、Twitter、YouTube、Tumblr、Instagram、9……等网站的视频或图片从此能像变魔术一样,按一个按钮就存到手机里了1 

但人们总发现这个方法「不那么靠谱」,这些能下载视频的 Workflow 往往过一段儿时间就不管用,需要重新去作者或者捷径库里搞一个新的版本。有的朋友可能想自己挑战一下动手改一改,但打开就会发现里面的东西自己完全看不懂。

而接下来的两周,我们将会讲解「如何制作从各种网站上获取你想要的内容的方法」,让你能够自己动手做出这样一个捷径,这样一来,在明白原理后,也不会在捷径不管用的时候只能听天由命,自己随手也能修好2 

需要用两周时间来学习这部分内容是因为有两套不同的方法。这两套不同的方法,恰好可以用费曼在《QED:光和物质的奇妙理论》里的故事来说明。

费曼在《QED:光和物质的奇妙理论》对台下并非物理学系的听众3 说,「……我准备怎么样给你们讲那些我对三年级以下的研究生都不讲的内容呢 ?让我用类比的方法说吧 !」

接下来他讲了一个历史故事:玛雅人为了计算金星升落的规律以及其它天体现象,发明了一套点画系统来表示数,同时还有一套计算规则,但仅有少数玛雅神父会做这种精巧的计算。这时假设我们是当时没有上过学的人,希望了解这种计算其中的一步,比如说减法,我们要怎么理解减法?神父会让我们数豆子——假定我们想从 584 中减去 236 ,就要先数出 584 粒豆子 ,把它们放到一个罐子里 ,然后从这些豆子里数出 236 粒放在一边 ,最后数数罐子里还剩下多少豆子 。这个数就是 584 减去 236 的结果 。

神父的方法和数豆子,就是我们要处理网页内容的两套办法。在概念上,通过 API 来解决问题更接近神父的方法,而一种我称之为「扒网页」的方法则更像是数豆子。

你可能会想,「我不要学数豆子,我比那聪明多了,我要直接学高明的方法。」

这种心情我很明白,但是和玛雅人的情况不同的是,我们要获取网页内容,但未必所有网站都提供 API,提供 API 的那些网站,也未必会提供我们要的那部分内容的 API,也有可能有 API 的那些服务申请使用 API 比较麻烦……总之,扒网页这个方法就像数数一样,可耻但有用,能应对的场景也许还更多。而且这种层面的方法,理解上也更符合直觉。

所以这一周,我们就先用「下载微博图片」作为练手,来体会用「扒网页」这种方法获取我们想要的内容。在讲解完示例后,我们这周会留下多个练习,它们有的是获取网页里的图片,有的是获取网页里的链接,有的是获取网页里的视频。这些练习都会直接附上可用的捷径用于参考。希望通过这些不同类型的「扒网页」练习,你能更全面地理解「扒网页」这种方法。