John the Ripper中LM格式在目标编码变更时的测试失败问题分析

2025-05-21 18:10:28作者：劳婵绚Shirley

问题背景

John the Ripper密码分析工具中的LM哈希格式最近在添加了包含8位字符的测试向量后，出现了在不同DOS代码页下自测试失败的问题。具体表现为当使用某些DOS代码页作为目标编码时，测试无法通过。

问题的核心在于新添加的测试向量中使用了两个特殊字符：

当这些字符被重新编码到某些DOS代码页时，会被识别为小写字符，导致John尝试对它们进行大小写转换。这种转换的结果显然是不正确的，从而引发了测试失败。

John the Ripper在处理不同编码时有一套复杂的转换逻辑。在自测试阶段，initUnicode()函数会被提前调用，以确保能够正确处理8位字符。当测试向量中的字符被重新编码到某些DOS代码页时：

原始的测试向量选择有其特定目的：

开发团队探讨了多种解决方案：

使用通用字符替代：寻找在所有支持的DOS代码页中表现一致的字符，如"°"（"\xf8"）或某些线条绘制字符
- 优势：这些字符在大多数DOS代码页中表现一致
- 挑战：CP868等特殊代码页缺少这些字符
禁用自测试时的大小写转换
- 问题：可能导致无法测试包含小写字符的向量
- 潜在性能影响需要评估
选择不被视为小写的代码点
- 即使在不同编码中代表不同字符，只要不被识别为小写即可

经过测试，发现使用"\xf8"（度符号）可以在所有支持的代码页中正常工作。因此：

这种修改既解决了编码转换问题，又保持了测试向量的有效性。

在问题完全修复前，用户可以使用--skip参数跳过有问题的测试。

这一问题的解决过程展示了密码分析工具中几个关键技术点：

该问题的解决不仅修复了当前的自测试失败，也为未来处理类似编码问题提供了参考方案。

登录后查看全文