指南

针对这些工具所解决问题的简短实操说明。

Base64 中文乱码:btoa 报错、atob 乱码和 UTF-8 的关系

btoa 遇到中文和 emoji 会抛异常,atob 解出来的中文是乱码,URL 安全写法和缺失填充还会让解码失败。从字节层面讲清原因,并给出正确的代码。

照片处理与压缩:三种"变小"其实是三件事

缩放、压缩、转换是三种不同的操作。本文给出先后顺序、质量档位的选择,以及放大、重复保存、透明通道和 方向标签这几个坑。

JS 正则表达式:测试器里通过、代码里失败的原因

正则语法没有统一标准。JavaScript、Python 与 PCRE 在锚点、\d、命名分组、行内标志和替换字符串上的具体差异,以及复制粘贴后的排查顺序。

JWT 解码和验证的区别:能看懂载荷不等于令牌可信

不需要密钥就能读出 JWT 的内容,所以解码成功说明不了什么。本文讲解码与验证的差别、alg 带来的漏洞、exp 为什么总是对不上,以及中文声明乱码的原因。

Markdown 转 HTML 源码:内嵌 HTML 的安全处理、GFM 差异与标题 id 锚点

Markdown 转 HTML 时,里面写的 HTML 和 javascript: 链接会怎样;为什么 List<String> 会消失;换行、表格和中文标题的锚点为什么在不同渲染器里表现不一样。

Markdown 转 PDF 和图片:图片版与文字版 PDF、A4 页边距、分页和中文乱码

在浏览器里把 Markdown 导出成 PDF 或 PNG:图片 PDF 和可选中文字 PDF 怎么选,A4 与 Letter 尺寸、页边距、分页被切断、长文档像素密度,以及中文乱码的真正原因。

关键词密度多少合适?这个数字能说明什么,不能说明什么

Google 说过不存在理想的关键词密度。本文讲密度怎么算、中文为什么只能看字组,以及怎样用它找出无意间的重复,而不是追一个目标值。

MD5 和 SHA256 区别:校验和不一致的原因与各算法的适用范围

MD5、SHA-1、SHA-256 到底差在哪,哪些场景还能用。同一段文字算出的哈希为什么对不上,密码为什么不能用它们存,文件校验的命令怎么写。

PDF 合并不上传:浏览器里到底做了什么,哪些内容会丢

怎样在文件不离开本机的前提下合并 PDF、怎样自己验证没有上传,以及真实的限制:加密文件、书签和元数据丢失、数字签名、内存上限。

密码多长才安全:熵怎么算,长度和符号哪个更值

密码熵等于长度乘以字符池大小的 log2。用具体数字说明为什么多加一位常比加符号更划算、为什么不能用 Math.random,以及熵值回答不了哪些问题。

照片元数据:哪些 EXIF 字段真的会暴露你

照片里可能藏着 GPS 经纬度、拍摄时间、相机型号和一张内嵌缩略图。本文说明怎样只删这些字段, 而不重新编码画面。

二维码容错率怎么选:L、M、Q、H 与对比度、留白

屏幕上能扫的二维码印出来却扫不出?讲清四档容错率如何拿容量换抗损坏能力、对比度和反色为什么会出问题、留白该留多少,以及汉字为什么特别占空间。

文本对比结果全是差异?换行符 CRLF、行尾空格和不可见字符排查

两段文字肉眼看一模一样,对比工具却整行标红:CRLF 与 LF、行尾空格、制表符、文件末尾换行、BOM、全角空格,逐一说明症状、成因和确认办法。

Unix 时间戳的常见错误:单位、时区与 1970

秒还是毫秒、UTC 还是本地时间、偏移还是时区名:时间戳被反复用错的几种情形,每条都给出识别症状与正确写法。

encodeURIComponent 和 encodeURI 区别,以及 URL 编码中文乱码的原因

查询参数、完整网址、表单提交各该用哪种编码;重复编码出现 %2520、decodeURIComponent 报 URI malformed、中文变乱码,这几类问题的成因和排查办法。

UTM 参数命名规范:怎样避免报表里同一个活动被拆成几行

UTM 参数怎么写才不会让数据四分五裂:大小写、分隔符、medium 取值、站内链接误用、井号顺序与编码,每个问题都对应原因和做法。

UUID v4 和 v7 区别:数据库主键该选哪个,v7 会泄露什么

随机的 v4 主键会让数据库索引越写越慢,按时间排序的 v7 能缓解这个问题,但也有代价。本文讲清楚位布局、同毫秒排序的细节和选型规则。

字数统计:中文、英文、表情符号到底怎么算

同一段文字在不同工具里字数不同,原因在于空格、表情符号、中英文混排和编码的算法。本文讲清楚字数、字符数、字节数各自的含义,以及短信、标题、推文的限制按什么算。

标题长度:该看像素宽度,不是数字数

搜索结果按渲染宽度截断标题,所以不存在绝对安全的字符数。本文给出真正需要控制的数值,以及发布前的检查方法。

JSON 为什么会报错:最容易踩中的 7 条规则

JSON 看起来像 JavaScript,却比它严格得多。绝大多数解析失败都出自这 7 条语法规则,本文说明如何快速定位出错的那一行。