RUKKENZH
Задать вопрос AI
РазделыОбъекты конфигурации 1С
Обработка «Автоматическое извлечение текстов» в УТ для Казахстана 3.4: зачем она нужна и как настроить
Версия статьи:📘 Для бухгалтера⚙️ Для тех-специалиста

Обработка «Автоматическое извлечение текстов» в УТ для Казахстана 3.4: зачем она нужна и как настроить

Актуально для: 1С:Управление торговлей для Казахстана, ред. 3.4.5.21 · ГК 1С-Сапа — партнёр фирмы «1С»
СТ
Сапа Т.И. — Эксперт по 1С и бухгалтерскому учёту, преподаватель-практик

Проверено на релизе 3.4.5.21 «Управление торговлей для Казахстана» (редакция 3.4).

Вы прикрепили к договору с поставщиком скан-акт в PDF и накладную в Word. Через неделю нужно быстро найти этот акт — вы вбиваете в полнотекстовый поиск номер из документа или фамилию подписанта, а система показывает «Ничего не найдено». Хотя файл точно есть. Причина почти всегда одна: из файла ещё не извлечён текст. Именно этим и занимается обработка «Автоматическое извлечение текстов» — она вытаскивает из ваших вложений (PDF, DOCX, XLSX, TXT) читаемый текст и отдаёт его механизму полнотекстового поиска. Пока она не отработала, файл для поиска — «немая картинка».

Сразу предупреждаю: это служебная (техническая) обработка, а не учётный документ. Она не делает бухгалтерских проводок, не формирует ЭСФ, СНТ или печатные формы и не трогает счета учёта. Поэтому ниже вы не найдёте разделов «Дт/Кт» и «печатные формы» в привычном смысле — вместо них разобрано, как обработка встроена в полнотекстовый поиск и как заставить её работать.

1. Назначение

Обработка извлекает текстовое содержимое из присоединённых файлов и передаёт его в индекс полнотекстового поиска. Благодаря ей вы находите документ не только по реквизитам карточки, но и по словам внутри вложенного файла. Работает в фоне — через регламентное задание, вручную её обычно не запускают.

2. Где найти

Прямого пункта в разделах «Продажи» или «Закупки» у неё нет — это не то, что открывают ежедневно. Есть три пути:

  • Напрямую по навигационной ссылке. Меню сервиса (значок «шестерёнка» вверху справа) → СервисОткрыть URL (или пункт «Перейти по навигационной ссылке») и вставьте:
    e1cib/list/Обработка.АвтоматическоеИзвлечениеТекстов
  • Через настройку поиска. НСИ и администрированиеНастройки программыОбщие настройки → блок Полнотекстовый поиск. Здесь включается сам поиск и извлечение текста.
  • Через регламентные задания. НСИ и администрированиеОбслуживаниеРегламентные и фоновые задания → найдите задание «Извлечение текста файлов» (или «Обновление индекса ППД»). Именно оно вызывает эту обработку по расписанию.

2а. Как узнать свой релиз

Меню «Справка» (или значок «i» / «Информация» в правом верхнем углу) → «О программе». В открывшемся окне вы увидите версию платформы «1С:Предприятие» (например, 8.3.24) и, отдельной строкой, релиз конфигурации — сверьте его с указанным в шапке: «Управление торговлей для Казахстана», редакция 3.4, версия 3.4.5.21. Если у вас другой релиз, расположение пунктов может немного отличаться.

3. Как настроить (полей для «заполнения» здесь нет)

У обработки нет привычной формы документа с реквизитами. Она управляется настройками полнотекстового поиска и параметрами регламентного задания. Разберём то, что реально влияет на результат.

ОБЯЗАТЕЛЬНО. Включить полнотекстовый поиск. НСИ и администрирование → Общие настройки → Разрешить полнотекстовый поиск данных. Если флажок снят — извлечение текста не имеет смысла, индекса нет, поиск по содержимому не работает.

ОБЯЗАТЕЛЬНО. Включить извлечение текста файлов. В том же блоке — флажок «Извлекать тексты файлов» (в разделе работы с файлами). Снят — файлы хранятся, но их содержимое остаётся невидимым для поиска.

Расписание регламентного задания. В карточке задания «Извлечение текста файлов» задайте периодичность (обычно раз в несколько минут или по ночам). Слишком редкое расписание = свежие вложения долго не находятся. Слишком частое на большой базе = лишняя нагрузка на сервер.

Учётная запись, под которой выполняется задание. На файловой базе задание идёт под текущим сеансом; на клиент-серверной — под служебной учёткой сервера. Если у неё нет прав на каталог хранения файлов, извлечение молча не выполняется. Проверьте права.

Место хранения файлов (том или база). Если файлы лежат в томах на диске, каталог тома должен быть доступен серверу 1С. Недоступен — текст не извлечётся, а в журнале регистрации появятся ошибки чтения файла.

Установленные конвертеры/фильтры ОС. Для PDF и офисных форматов платформа использует внешние компоненты и IFilter-фильтры операционной системы. Нет установленного фильтра для формата — из такого файла текст не вытащить (типичный случай — отсканированный PDF без текстового слоя).

Отдельно подчёркиваю: вручную «заполнять» и запускать обработку каждый раз не нужно. Правильная эксплуатация — один раз включить настройки и настроить расписание, дальше всё идёт автоматически.

4. Разобранный пример

Ситуация. Бухгалтер ТОО «Астана-Снаб» прикрепляет к поступлению товаров от поставщика два файла: Акт_сверки_2026.pdf и Накладная_1450.docx. В тексте акта есть строка «задолженность на 01.09.2026 составляет 1 856 000 ₸».

Что происходит по шагам:

  1. Файлы сохраняются в справочник присоединённых файлов, у каждого проставляется признак «Текст не извлечён».
  2. По расписанию срабатывает регламентное задание → вызывается обработка «Автоматическое извлечение текстов».
  3. Обработка открывает Акт_сверки_2026.pdf, через фильтр ОС читает текстовый слой и сохраняет извлечённый текст в реквизит файла; признак меняется на «Текст извлечён». То же — с DOCX.
  4. Полнотекстовый индекс обновляется.
  5. Теперь бухгалтер в поиске вводит 1 856 000 или задолженность на 01.09.2026 — и система находит именно этот акт и связанный с ним документ поступления.

Обратите внимание, чего в этом примере нет и быть не может: ни одной бухгалтерской проводки, никакого движения по счетам 1210, 1330, 3310, 3130, никакого начисления НДС по ставке 16 %, никакого ЭСФ или СНТ. Обработка работает только с текстом файлов. Все учётные движения (Дт 1330 Кт 3310 на стоимость товара, Дт 1420 Кт 3310 на входящий НДС и т. д.) делает сам документ поступления — а не эта служебная обработка.

5. Виды операции (режимы работы)

«Видов операции» как у документа тут нет, но есть режимы, в которых обработка вызывается:

Режим Когда срабатывает
Фоновое извлечение по расписанию Основной режим — регламентное задание «Извлечение текста файлов»
Извлечение при обновлении индекса При перестроении/обновлении полнотекстового индекса ППД
Разовое извлечение по требованию При открытии файла или обращении к нему, если текст ещё не извлечён
Повторное извлечение После замены файла новой версией — старый текст замещается новым

6. Что формируется при работе

Никаких проводок, электронных документов (ЭСФ/СНТ) и регистров бухучёта обработка не создаёт. Результат её работы:

  • Извлечённый текст записывается в служебный реквизит присоединённого файла.
  • Признак извлечения файла переключается с «Текст не извлечён» на «Текст извлечён».
  • Обновляется полнотекстовый индекс — после этого файл участвует в поиске по содержимому.
  • В журнал регистрации пишутся служебные записи об успехе или об ошибке извлечения (по ним удобно диагностировать проблемы).

7. Печатные формы

У служебной обработки печатных форм нет — печатать здесь нечего. Печатные формы (счёт-фактура, накладная ТОРГ, акт) относятся к учётным документам, к которым вы прикрепляете файлы, а не к механизму извлечения текста.

8. Частые ошибки

  • «Полнотекстовый поиск не разрешён» при попытке искать по содержимому. Включите флажок в НСИ и администрирование → Общие настройки → «Разрешить полнотекстовый поиск данных», затем дождитесь построения индекса.
  • «Индекс полнотекстового поиска не актуален» — поиск находит не всё. Запустите обновление индекса (в настройках поиска — кнопка «Обновить индекс») или дождитесь регламентного задания.
  • «Ошибка при извлечении текста файла» / «Не удалось открыть файл» в журнале регистрации. Чаще всего — недоступен каталог тома для сервера 1С либо у служебной учётки нет прав. Проверьте путь к тому и права доступа.
  • Файл есть, а текст пустой. Это отсканированный PDF/JPG без текстового слоя — извлекать нечего. Нужен OCR-распознанный PDF или установленный фильтр формата.
  • «Регламентное задание отключено». Задание «Извлечение текста файлов» выключено или без расписания — включите и задайте расписание.

9. FAQ

Смотрите раздел вопросов ниже.

10. Смежные объекты

  • Присоединённые файлы (вложения к документам и элементам справочников) — источник, из которого извлекается текст. Обработка без них бессмысленна.
  • Полнотекстовый поиск данных — потребитель результата; именно он использует извлечённый текст.
  • Регламентные и фоновые задания — механизм, который запускает обработку по расписанию.
  • Тома хранения файлов — место, откуда обработка читает содержимое.

Учётные документы (Поступление товаров и услуг, Реализация, Акт сверки), к которым вы прикрепляете файлы, связаны с обработкой только через эти вложения — сами проводки, ЭСФ и СНТ формируются в них, а не здесь.


Как узнать свой релиз

«Справка» → «О программе». В окне указаны версия платформы «1С:Предприятие» и релиз конфигурации. Все шаги выше проверены на релизе 3.4.5.21 конфигурации «Управление торговлей для Казахстана» (редакция 3.4); на других релизах названия пунктов меню могут немного отличаться.

Методичка подготовлена для «Управление торговлей для Казахстана», релиз 3.4.5.21.

Частые вопросы

Обработка «Автоматическое извлечение текстов» делает бухгалтерские проводки?
Нет. Это служебная (техническая) обработка. Она не формирует проводок, не трогает счета (1210, 1330, 3310, 3130 и т. д.), не начисляет НДС. Она только извлекает текст из присоединённых файлов для полнотекстового поиска. Все учётные движения делают сами документы — поступление, реализация и прочие.
Формирует ли она ЭСФ или СНТ?
Нет. Электронные счета-фактуры (ЭСФ в ИС ЭСФ) и сопроводительные накладные (СНТ) выписываются из учётных документов реализации/перемещения, а не из этой обработки. К извлечению текста файлов они отношения не имеют.
Почему я не могу найти прикреплённый PDF по словам внутри него?
Скорее всего, из файла ещё не извлечён текст. Проверьте, что включён полнотекстовый поиск и извлечение текстов файлов, а регламентное задание «Извлечение текста файлов» работает по расписанию. После его отработки и обновления индекса файл начнёт находиться по содержимому.
Где включить извлечение текста файлов?
НСИ и администрирование → Настройки программы → Общие настройки. Включите «Разрешить полнотекстовый поиск данных» и флажок извлечения текстов файлов, затем настройте расписание регламентного задания.
Почему из отсканированного PDF текст не извлекается?
Потому что в таком файле нет текстового слоя — это изображение страницы. Извлекать нечего. Нужен PDF, распознанный OCR, либо документ в текстовом формате. Обработка не выполняет распознавание картинок.
Нужно ли запускать обработку вручную каждый раз?
Нет. Правильный режим — один раз включить настройки поиска и извлечения и настроить расписание регламентного задания «Извлечение текста файлов». Дальше извлечение идёт в фоне автоматически при добавлении и замене файлов.
Как открыть обработку напрямую?
Через меню сервиса выберите переход по навигационной ссылке и вставьте e1cib/list/Обработка.АвтоматическоеИзвлечениеТекстов. Но в повседневной работе открывать её вручную обычно не требуется.
В журнале регистрации ошибка извлечения текста — что делать?
Чаще всего серверу 1С или служебной учётной записи недоступен каталог тома, где хранятся файлы. Проверьте путь к тому хранения и права доступа. Также убедитесь, что в ОС установлен фильтр (IFilter) для нужного формата файла.

Читайте также

Источники

Была ли статья полезна?
💼 Нужна помощь с 1С или учётом? Слава КВЦ — многолетняя практика в 1С в Казахстане. Изучите разложенный НК РК 2026 или спросите в чате BuhGPT — ответит за секунды.