最新Python untokenize 往返边界:词元完全相同,为什么源码空格和返回类型仍然变了 写源码改写器时,先切成词元、再原样拼回,看上去应该什么都没改。但版本控制却出现一堆空格差异,写文件时还可能因bytes和str类型不一致而报错。问题在于词元往返和字节往返是两份不同契约:前者保住语言片段及其顺序,后者... yunqueblog/ 技术教程/ 2026-10-04/ 3 阅读
Python codecs 的转换类型:rot_13 明明能查到,为什么字符串 encode 却拒绝它 维护一段旧文本工具时,看到注册表里有rot_13,于是直接调用字符串的encode,结果得到LookupError。换成codecs.encode却立即成功。错误名称很容易让人以为机器缺少编码器,实际关键是调用接口要... yunqueblog/ 技术教程/ 2026-10-03/ 3 阅读
Python Base64 严格解码:字符合法之后,还要约定字母表与填充 上传接口收到一段编码字符串,解码成功并不一定说明输入格式符合协议。Python 的 Base64 默认解码会先丢弃不属于字母表的字符,再检查填充。因此,把异常捕获当作唯一的输入验收,有时会放过原本应该拒绝的标点与空白... yunqueblog/ 技术教程/ 2026-10-01/ 3 阅读
Python 读写 CSV:编码、换行和字段边界要分别处理 CSV 看起来像“逗号分隔的文本”,但直接 split 逗号很快会遇到带引号的地址、跨行备注和编码问题。可靠处理需要分清三层:字节用什么编码解码,CSV 方言怎样描述字段,业务如何解释字段值。本文基于 Python ... yunqueblog/ 技术教程/ 2026-10-01/ 5 阅读