Текст копируется иероглифами: что делать и как исправить кодировку

Когда скопированный из PDF, браузера или документа текст при вставке превращается в набор иероглифов, квадратов или «кракозябр», первое, что нужно проверить, — кодировку исходника и программы, в которую вы вставляете данные. Проблема почти всегда связана с несовпадением кодировок: например, текст сохранён в Windows-1251, а программа читает его как UTF-8, или наоборот.

Хорошая новость в том, что сами данные при этом не испорчены — буквы на месте, просто компьютер интерпретирует их неправильно. Ниже разберём, почему так происходит, как быстро восстановить читаемый текст и что настроить, чтобы проблема не повторялась.

Почему текст превращается в иероглифы

Каждый символ в компьютере хранится как число, а таблица соответствия чисел и букв называется кодировкой. Если файл создан в одной кодировке, а открывается в другой, программа подставляет не те символы — и вместо русских букв появляются знаки вроде «РўРµРєСЃС‚» или «Òåêñò». Это и есть классические «кракозябры».

Отдельный случай — копирование из PDF-документов. Там текст может быть встроен без корректной таблицы соответствия символов (ToUnicode), и при копировании вы получаете мусор, даже если на экране всё выглядит нормально. Это ограничение самого файла, а не вашей системы.

  • 📄 Несовпадение кодировок: файл в Windows-1251 открыт как UTF-8 или наоборот
  • 🌐 Браузер неверно определил кодировку страницы при копировании
  • 📑 PDF без встроенной таблицы соответствия символов — текст отображается, но не копируется корректно
  • 🔤 В системе отсутствует шрифт, использованный в документе, и символы заменяются квадратами
  • ⚙️ Сбит системный параметр «Язык программ, не поддерживающих Юникод» в Windows

Быстрая диагностика: где именно ломается текст

Прежде чем что-то исправлять, определите, на каком этапе возникает проблема. Скопируйте фрагмент и вставьте его по очереди в Блокнот, Word и адресную строку браузера. Если в одной программе текст читается, а в другой — нет, дело в настройках конкретного приложения, а не в источнике.

Если текст «ломается» уже в Блокноте, вероятнее всего, проблема в самом источнике или в системных региональных настройках. Если же везде вставляется нормально, кроме одной программы, — ищите настройки кодировки именно в ней.

📊 Откуда вы копируете текст, который превращается в иероглифы?
Из PDF-документа
С веб-страницы в браузере
Из текстового файла (TXT)
Из Word или другой программы

Способ 1. Исправить кодировку при открытии файла

Если иероглифы появляются при открытии TXT-файла, пересохраните его в правильной кодировке. Откройте файл в Блокноте, выберите Файл → Сохранить как и в выпадающем списке «Кодировка» попробуйте варианты UTF-8 и ANSI. Один из них даст читаемый результат при повторном открытии.

Более гибкий вариант — бесплатный редактор Notepad++: в меню Кодировки можно переключать представление файла на лету и сразу видеть, при какой кодировке текст становится читаемым. После этого используйте пункт «Преобразовать в UTF-8» и сохраните файл.

☑️ Как исправить кракозябры в текстовом файле

Выполнено: 0 / 4

Способ 2. Настроить язык для программ без Юникода в Windows

Если иероглифы появляются сразу во многих программах — в меню, диалогах, старых приложениях — проверьте региональные настройки. Откройте Панель управления → Часы и регион → Регион → вкладка «Дополнительно» и нажмите «Изменить язык системы». Для русскоязычных программ там должно быть выбрано «Русский (Россия)».

⚠️ Внимание: изменение языка системы для программ без Юникода требует перезагрузки компьютера. Сохраните все открытые документы перед применением настройки.

После перезагрузки проверьте проблемную программу заново. Если путь к настройке отличается в вашей версии Windows, воспользуйтесь поиском в Параметрах по слову «регион» — точное расположение пункта зависит от версии системы.

Способ 3. Решить проблему при копировании из PDF и браузера

С PDF ситуация сложнее: если в файле нет корректной таблицы символов, ни одна программа не скопирует текст правильно. Рабочее решение — распознавание текста (OCR). Откройте документ в программе с функцией OCR (например, в просмотрщиках с поддержкой распознавания или онлайн-сервисах) и получите редактируемый текст заново.

При копировании с веб-страниц попробуйте вставку без форматирования: в Word и многих редакторах работает сочетание Ctrl + Shift + V или пункт «Вставить только текст». Так вы отсечёте конфликтные стили и шрифты страницы. Если иероглифы видны уже на самой странице, проверьте в настройках браузера, не отключено ли автоматическое определение кодировки.

Сравнение способов восстановления текста

СитуацияЧто делатьСложность
Кракозябры в TXT-файлеСменить кодировку в Notepad++ и пересохранитьНизкая
Иероглифы во многих программахПроверить язык программ без Юникода в WindowsСредняя
Текст не копируется из PDFРаспознать документ через OCRСредняя
Мусор при вставке с сайтаВставка без форматирования (Ctrl+Shift+V)Низкая
Квадраты вместо буквУстановить недостающий шрифтНизкая
⚠️ Внимание: если текст превращается в квадраты или пустые рамки, а не в «кракозябры», причина почти наверняка в отсутствующем шрифте, а не в кодировке. Смена кодировки в этом случае не поможет — нужно установить шрифт, использованный в документе.
Как отличить проблему кодировки от проблемы шрифта

При сбое кодировки вместо букв появляются другие символы — латиница с «крючочками», знаки валют, иероглифы. При проблеме со шрифтом символы заменяются одинаковыми квадратами или пустыми прямоугольниками. Первое лечится сменой кодировки, второе — установкой нужного шрифта в систему.

Как предотвратить проблему в будущем

Несколько простых привычек избавят от повторения ситуации. Сохраняйте все текстовые файлы в UTF-8 — эта кодировка стала стандартом и корректно читается практически везде. При обмене документами с коллегами используйте форматы DOCX или PDF с встроенными шрифтами, а не устаревшие форматы.

Если регулярно работаете со старыми файлами, держите под рукой редактор с ручным выбором кодировки — это сэкономит массу времени при диагностике.

Частые вопросы

Почему текст из PDF копируется иероглифами, хотя выглядит нормально?

В PDF-файле может отсутствовать таблица соответствия глифов и символов (ToUnicode). На экране буквы рисуются корректно, но копировать их как текст невозможно. Решение — распознать документ через OCR.

Что означают символы вида «РўРµРєСЃС‚»?

Это признак того, что текст в кодировке UTF-8 был прочитан как Windows-1251. Переключите кодировку отображения файла на UTF-8 — и текст станет читаемым.

Поможет ли переустановка программы, если текст копируется иероглифами?

Вряд ли. Проблема почти всегда в кодировке файла, настройках системы или самом источнике, а не в установке программы. Начните с проверки кодировки и региональных параметров.

Иероглифы появляются только в одной старой программе. Что делать?

Проверьте параметр «Язык программ, не поддерживающих Юникод» в региональных настройках Windows — для русскоязычных приложений там должен быть выбран русский язык. После изменения потребуется перезагрузка.

Можно ли восстановить текст, который уже вставлен иероглифами в документ?

Да, если известна исходная кодировка. Скопируйте «испорченный» фрагмент в редактор со сменой кодировки (например, Notepad++) или воспользуйтесь онлайн-декодером кракозябр — он перекодирует текст обратно в читаемый вид.