Кодируйте текст в hex-байты и декодируйте обратно с корректным UTF-8 (кириллица, эмодзи). Есть классический дамп: смещение · байты · ASCII.
Текст кодируется в UTF-8, поэтому не-латинские символы и эмодзи занимают несколько байт — например, «й» это d0 b9.
Свободный hex: пробелы, переводы строк, префиксы 0x и запятые убираются автоматически. Нечётное число цифр или не-hex символы отклоняются.
Он показывает байты с их смещениями и печатный ASCII — классический способ разглядывать бинарные данные.