惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

大猫的无限游戏
大猫的无限游戏
Webroot Blog
Webroot Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
T
Threat Research - Cisco Blogs
V2EX - 技术
V2EX - 技术
L
LINUX DO - 热门话题
Google DeepMind News
Google DeepMind News
Recorded Future
Recorded Future
S
Schneier on Security
I
InfoQ
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
The GitHub Blog
The GitHub Blog
S
Security @ Cisco Blogs
O
OpenAI News
W
WeLiveSecurity
Vercel News
Vercel News
阮一峰的网络日志
阮一峰的网络日志
Simon Willison's Weblog
Simon Willison's Weblog
人人都是产品经理
人人都是产品经理
Cloudbric
Cloudbric
The Last Watchdog
The Last Watchdog
The Hacker News
The Hacker News
Google Online Security Blog
Google Online Security Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
GbyAI
GbyAI
NISL@THU
NISL@THU
T
Tailwind CSS Blog
V
Visual Studio Blog
PCI Perspectives
PCI Perspectives
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
Jina AI
Jina AI
D
DataBreaches.Net
B
Blog RSS Feed
N
News and Events Feed by Topic
N
News and Events Feed by Topic
H
Heimdal Security Blog
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
腾讯CDC
Latest news
Latest news
V
Vulnerabilities – Threatpost
Hacker News: Ask HN
Hacker News: Ask HN
WordPress大学
WordPress大学
V
V2EX
aimingoo的专栏
aimingoo的专栏
博客园 - 司徒正美
Apple Machine Learning Research
Apple Machine Learning Research
D
Darknet – Hacking Tools, Hacker News & Cyber Security
The Register - Security
The Register - Security
Help Net Security
Help Net Security

smallyu的博客

为什么买的加密货币一定要去中心化 RISC-V 虚拟机无法代替 EVM 虚拟机 Polkadot 的 Existential Deposit 机制错在哪里 利息,套利,交易策略,金融市场 LayerZero 从来不挑战比特币的地位 默认参数引起的以太坊节点运行错误 硬件钱包与资产安全 预测市场比币圈更赌场 为什么去中心化的跨链桥不可能实现 我对于 AI 时代的答案 不要投资任何隐私币 区块链技术世界的三大真理 以太坊 AA 钱包的致命问题是什么 基于 AI 语义执行的 MCP 区块链的设计 一个集成 Geth 和 CometBFT 的兼容层 我的加密货币定投策略(二) DeFi 基础: 理解 AMM 定价机制 Go 语言 GMP 调度器的原理是什么 Web3 项目分析计划 对 Psyche Network 项目的分析 continuation 教程: 理解 CPS 如何开发一个比特币符文(Runes)协议 比特币脚本开发教程 我从王垠的计算机科学视频班学到了什么 区块链技术面试题(2025年版) Rust 语言容易让新手困惑的一个“过度优化” Solana 智能合约开发教程 (1) 尝试开发一个最小 EVM 虚拟机 基于 ZK 的链上身份系统设计 一个 Web3 打赏系统的设计 鼓吹 Cursor 的人技术能力都差 关于 Code Review 的礼节 假如启动一个新的以太坊 PoS 网络 发行加密货币的最好方式 所有 BFT 共识的区块链都是中心化的 对 2025 年区块链行业的预测 Restaking 项目的经济难题 如何看懂任意区块链项目的技术架构 为什么不要做以太坊的二次开发 为什么不要做智能合约开发和 DeFi 开发 我的加密货币定投策略(一) PoS 类型的区块链如何处理分叉 Ethereum Casper 为什么需要 EIP-7251 区块链中的 PBFT 不需要第二次投票 开发者的思维方式 发币的核心要点 炒币投资的小 tips 为什么说 PoW 比 PoS 更加去中心化 牛市对普通人来说意味着什么 如何健康地远程工作 为什么比特币不用概率加密函数 程序员的 “服从权威” 心理 区块链技术面试题 如何区分公有链和联盟链 对 Layer 2 项目创业想法的回复 对区块链共识机制的理解 Pebbling Game 鹅卵石游戏 PDP 文件证明的局限性 不要小瞧 ChatGPT 为什么炒币不是一个好主意 一种在区块链上生成随机数的机制 为什么以太坊的私钥计算不可逆 关于以太坊的私钥碰撞 “猜均值的2/3” dApp 游戏设计 Proof of Storage/Space/Replication 的区别 Proofs of Retrievability 文件证明的含义 对 S-PDP 文件证明的示例和解释 我的加密货币交易机器人 对区块链行业的见闻 随机确认块的共识机制 VRF + BFT 共识引起交易失败的问题 为什么要重视编程思想 对 Web 3.0 的理解 GitBook 好用吗? 一种区块链节点存储扩容的方式 一种基于“自我中心主义”的共识机制 链表常见算法题及解析 基于 Multi-Linked List 的区块链设想 理解哈希函数与序列化 联盟链比公有链差在哪儿 在 Dijkstra 算法中保存路径 为什么数字货币使用区块链是政治问题 区块链:下一代数字身份认证体系的基石 网页技术能实现 3D 建模吗? 给区块链一个定义 从 Erlang 开始了解 Actor 模型 一种侧边导航栏的交互方式 Rust 的 ownership 是什么? Haskell 中的 Monad 是什么? 浅析 Libra 背后的区块链技术 对区块链的理性认识 Rust 基础语法概述 基于 Java 的爬虫框架 WebCollector Kotlin:简化版的 Scala JavaScript 有关联数组吗? 主流编程语言的异常处理机制 Go 语言基本语法 Scala 语法基础 用 Scala 改写 Java 浅度实践 HTML5 音乐可视化
Python 获取海贼王更新信息
2018-12-02 · via smallyu的博客

2018-12-02

12月2日,晴,海贼王停更。

问题

做为一个合格的肥宅,海贼王和妖精的尾巴每周必追。这两部动漫播放源都在爱奇艺,都是VIP内容。每周末看动漫,都要在YouTube或其它网站上找资源。问题是,资源网站的更新往往不及时,常常需要Google“动漫名称 + 最新集数”,比如“海贼王 864”。

每个星期都精确的记住一部动漫应该更新的最新一集集数是多少,恐怕不是正常肥宅会做的事情,况且两部。这样,每次搜索资源前,都需要进入爱奇艺,搜索海贼王,看到最新的一集集数,关闭页面,进入Google搜索。妖精的尾巴也要同样的操作来一次。

而且,在爱奇艺里看到最新一集集数的瞬间,无法判断它是否停更,还需要在复杂的PC页面中找到“更新时间”这一标签,看更新状态是否正常,才可以做出判断。至于手机页面或APP,更是没有途径可以查看动漫的更新状态。

另一个获取动漫最新集数的方式是,百度直接搜索动漫名称,首页就倒序显示最新几集的列表(这一点百度好于谷歌),但也无法判断更新是否正常。再者,浏览器默认为Google,百度搜索需要先输入baidu,按TAB切换至百度搜索引擎,再输入要搜索的内容敲回车,步骤同样繁琐。

解决

写一段简单的Python脚本,从爱奇艺页面上抓取信息,自己直接访问程序便能知晓动漫的更新情况。引入工具包:

import urllib.request
from bs4 import BeautifulSoup
from wsgiref.simple_server import make_server

# 海贼王页面链接
url = "http://www.iqiyi.com/a_19rrhb3xvl.html?vfm=2008_aldbd"

urllib用于发送http请求,并接收页面数据;bs4用于解析页面,更轻易获取内容;wsgiref用于建立http服务器,提供网络服务。url是全局变量,储存海贼王页面的链接地址。

# 从页面获取数据
def reciveData(url):
  # 获取页面内容
  response = urllib.request.urlopen(url)
  html = response.read()
  # 解析器
  soup = BeautifulSoup(html, "html.parser", from_encoding="utf-8")
  # 更新时间
  p = soup.find('p', class_="episodeIntro-update")
  # 最新集数
  i = soup.find('i', class_="title-update-num")
  return p, i

这几行代码发送了请求,并从页面中获取信息。这里更新时间和最新一集集数的信息就已经拿到了。接着要创建一个http服务器,让程序输出内容到页面:

# 服务器环境的处理函数
def application(environ, start_response):
  # 获取数据
  p, i = reciveData(url)
  # 拼接出页面内容
  start_response('200 OK', [('Content-Type', 'text/html')])
  content = ('<h3>海贼王</h3>'
            + 'msg: ' + p.contents[2].get_text().strip() 
            + '<br>'
            + 'num: ' + i.get_text())
  return [bytes(content, encoding = "utf-8")]

最后启动一个本地服务器,访问8010端口即可看到页面。可将程序部署到服务器,之后直接访问服务器:

# 启动服务器
httpd = make_server('', 8010, application) 
httpd.serve_forever()

运行结果如图:

扩展

从这一想法出发,可以扩展程序。一种是从各大网站获取全面的动漫更新信息,主动提供服务;再一种是根据用户的输入,提供自定义的动漫更新信息;或者将两者结合,提供一种大而全的、可收藏、可定制的服务。虽然这种想法毫无意义。

更正

之前的代码犯了一个低级错误,程序只会在首次运行时发起网络请求,之后由于网络服务一直处于启动状态,返回网页的内容始终都是初始数据。解决这个问题也很容易,将请求网络的操作封装到一个函数中,再到application函数中调用该函数即可。(代码已更正,为保证简洁,去掉了妖尾部分的代码和控制台的日志输出)