Для KOI8-R локали:
for locales in "CP1251 UTF8 866 foo bar"; do
egrep -R . -i "`echo search string | iconv -f $locales -tKOI8-R`"
done
Что-то типа такого.
Спасибо всем ответившим, но возникла пара новых вопросов.
Текст индексируется с учетом его кодировки и потом не возникнет проблем, если индексируемый текст был в разных кодировках?
Как пользоваться python-chardet?
Вариант с перебором локалей проще всего сделать, но есть ли способ быстрее и покрасивее, чтобы внутри grep проверять подстроку для поиска в разных кодировках, а не грепать несколько раз подряд?