from __future__ import annotations:作用、用法与 Python 3.14 变化
from __future__ import annotations 到底有什么用?本文讲清前向引用、字符串化标注、TYPE_CHECKING、get_type_hints 常见坑,以及 Python 3.14 延迟求值后的保留与删除策略。
from __future__ import annotations 到底有什么用?本文讲清前向引用、字符串化标注、TYPE_CHECKING、get_type_hints 常见坑,以及 Python 3.14 延迟求值后的保留与删除策略。
Python 没有 interface 关键字,但可通过鸭子类型、ABC、typing.Protocol 和 NotImplementedError 定义接口。本文结合可运行示例,对比检查机制与选型,并说明 Protocol 从 Python 3.8、内置泛型从 3.9 开始等版本边界。
Python 类型标注不会自动校验运行时数据,却能配合 mypy 在执行前发现参数、返回值和 None 等问题。本文从版本兼容、常用语法、Any 与 object、运行时校验到项目落地完整讲清。
Python 的 Lock 与 RLock 都能保护多线程共享数据,关键区别在于同一线程能否重复获取同一把锁。本文用可运行示例讲清重入机制、递归计数、死锁边界与实际选型。
面向只学过 class 和 __init__() 的新手,从 dataclass 的作用讲起,逐步解释 __repr__()、__eq__()、field、default_factory、kw_only、slots、frozen、match_args 与常用辅助函数。
Python 爬虫如何模拟登录?本文从 Network 抓包判断 Cookie、JWT/Token 与浏览器状态,给出 requests.Session、Authorization、Playwright 三种可运行方案,并附 401/403 排查清单。
爬虫遇到 403、验证码、IP 被封怎么办?本文从代理 IP 原理、requests proxies 写法、账号密码认证、短效代理和隧道代理选择、失败重试与合规边界讲清排查思路。
本文用 TraceCloud 第 15 到第 18 关串起 CSS 偏移、CSS content、固定字体映射和动态字体反爬,重点讲清自定义字体、Unicode 私有区、WOFF2、fontTools、cmap 和字形轮廓比对的完整处理思路。
本文从 requests.Session 的状态保持机制出发,说明 Cookie、验证码接口、失败重试和 403 排查之间的关系,适合需要处理登录态、验证码校验或翻页采集的 Python 爬虫场景。
aiohttp 怎么用?本文从 GET、POST、params、headers、响应读取讲到超时、异常处理、并发控制、连接池和重试封装,适合写 Python 异步爬虫和批量接口请求。
面向爬虫和 Web 自动化学习者的 Playwright Python 入门教程,覆盖安装、同步与异步模式、元素定位、等待策略、上下文管理、网络拦截、截图调试和实践建议。
XPath 是爬虫里精准定位网页元素的核心技能,本文从节点选取、谓语、轴运算到 Python lxml 实战,全面讲解 XPath 语法与避坑指南。