Есть текстовые файлы, записанные в ~1988 году. (Если запостивший их соврал, то не позднее 1998.) Большая часть символов — 7-битный ASCII. Для некоторых знаков препинания (которые можно только угадывать из контекста) используется странная кодировка:
0x8a — многоточие или тире,
0x8b — короткое тире или дефис,
0x8c — открывающая кавычка, для которой 0xb9 — закрывающая,
0xad — может быть запятая (или одинарная нижняя кавычка), тире, двоеточие, многоточие,
0xb2 — закрывающая кавычка в паре с 0xb3,
0xb3 — открывающая кавычка в паре с 0xb2,
0xb9 — апостроф или одинарная верхняя кавычка.
Неясно, одинарные кавычки или двойные; ёлочки, лапки, или что-нибудь ещё; не перепутан ли порядок кавычек; как соотносятся длины тире.
Enca ничего подходящего не нашла. Перебор кодировок iconv дал ISO-IR-90 или ISO-IR-99 для 0xb9 как одинарной кавычки/апострофа и ничего подходящего для остальных. Возможно, эти файлы несколько раз перекодировали.
Как узнать, в какой кодировке были эти файлы? Просто интересно.
Если перебирать комбинации кодировок скриптом, как это лучше делать?


