Мультимодальный ИИ — это модель, которой можно показать картинку вместе с вопросом. Чек, скриншот ошибки, фото доски, схему процесса или рукописную заметку — всё это она попробует прочитать, объяснить и превратить в следующий шаг.
Звучит удобно. Но гладкий ответ легко принять за истину. Одна неверная цифра в чеке, потерянное «не» в заметке или перепутанная стрелка на схеме создадут больше работы, чем сэкономят.
Полезная роль ИИ здесь простая: он делает первый разбор, а человек проверяет всё, что дорого исправлять. Это суммы, реквизиты, условия договора, права доступа и изменения в рабочих процессах.

Лучше всего модель справляется с чётким изображением, крупным текстом и ясным заданием. Хуже — с бликами, мелким шрифтом, повёрнутым фото, зачёркиваниями и обрезанными фрагментами. В справке ChatGPT о работе с изображениями прямо перечислены ограничения: мелкие детали, точное расположение объектов, подсчёт и графики могут быть проблемными.
Главный риск — не обычная ошибка, а уверенная догадка. Модель может не разобрать символ и подставить правдоподобный вариант. Поэтому просите её отделять то, что видно, от предположений. Честное «не могу прочитать» полезнее красивой выдумки.
Чек: переносите данные, но не сдавайте отчёт без сверки
ИИ удобно использовать после командировки, когда нужно собрать несколько чеков в таблицу расходов. Он может вынести продавца, дату, валюту, позиции и итог. Это экономит время на ручном вводе.
Но термобумага выцветает, названия товаров сокращают, а итог и реквизиты печатают мелко. Сотрудник прислал чек за такси для авансового отчёта. Модель перенесла данные в таблицу, а сотрудник сверил по фото итог, дату, валюту и продавца. Так ошибка распознавания не попала в отчётность.
Извлеки из чека только то, что видно: продавец, дата, валюта, позиции, количество, цена, скидка и итог.
Не угадывай нечитаемые символы. Каждый сомнительный фрагмент пометь [неразборчиво].
Сделай таблицу:
— поле;
— значение;
— уверенность: высокая, средняя или низкая.
В конце перечисли поля, которые нужно сверить с оригиналом вручную.Суммы, ИНН, номера документов и платёжные реквизиты проверяйте глазами. Здесь ИИ — быстрый оператор ввода, а не бухгалтер.
Скриншот ошибки: объяснит сообщение, но не найдёт причину сам
Скриншоты ошибок — полезный сценарий, когда нужно перевести технический текст на человеческий язык. ИИ может выписать код ошибки, объяснить термин и предложить безопасные первые проверки.
Менеджер нажал «Экспорт в XLSX» в CRM и увидел `Access denied`. Модель объяснит: система отказала в доступе. Затем она предложит проверить роль сотрудника, права на выгрузку и срок сессии.
Но ИИ не видит журнал событий, настройки сервиса и действия коллег до ошибки. Фраза «это точно проблема с базой данных» остаётся гипотезой, даже если звучит убедительно.
Разбери скриншот ошибки в двух частях.
Сначала выпиши наблюдения:
— точный текст;
— код ошибки;
— название сервиса;
— видимые кнопки и поля.
Потом назови до трёх гипотез. Для каждой укажи, на чём она основана, что проверить первым и какое действие безопасно.
Не называй причину подтверждённой, если её нет на скриншоте.Не удаляйте интеграции и не сбрасывайте настройки по совету модели. Сначала проверьте гипотезу в самой системе.
Схема: подписи прочитает, связи перепутает
ИИ может назвать блоки на схеме и пересказать общий маршрут. Это помогает перед встречей: вы быстрее понимаете, кто создаёт документ, кто его согласует и где появляется финальное решение.
Но смысл схемы часто сидит в мелочах: стрелках, пунктирных линиях, подписях «да» и «нет», возвратах и исключениях. Блоки, стоящие рядом, не обязательно связаны.
Руководитель попросил превратить схему согласования платежа в список этапов. ИИ заметил блок «Юрист» и развилку после него. Руководитель сверил стрелку с оригиналом: она вела в «Доработку», а не в «Финансы». Команда не внедрила несуществующий маршрут.

Опиши схему как процесс.
Для каждого блока укажи:
— точную видимую подпись;
— входящие связи;
— исходящие связи;
— направление, только если стрелка видна.
Отдельно перечисли развилки, циклы, нечитаемые подписи и связи, в которых ты не уверен.
Не считай блоки связанными только потому, что они стоят рядом.Не меняйте процесс по текстовой расшифровке. Сначала сравните каждый переход со схемой.
Рукопись: не разрешайте модели «наводить порядок»
ИИ помогает разобрать заметки с доски, итоги встречи и списки задач. Но в рукописи он может раскрыть сокращение, исправить слово или превратить обрывок фразы в законченную мысль.
После встречи у менеджера осталась запись: «созв. с Олей, 15:30?». Модель способна превратить её в «созвон с Ольгой в 15:30». Для личной заметки это терпимо. Для задачи команде рискованно: вопросительный знак мог означать, что время ещё не подтвердили.
Расшифруй рукопись максимально близко к оригиналу.
Не исправляй орфографию и не раскрывай сокращения без пометки.
Не угадывай даты, суммы, имена, адреса и номера.
Сомнительные фрагменты заключай в [квадратные скобки].
Сохрани переносы строк и структуру списка.
После расшифровки выдели задачи только из строк с высокой уверенностью.Не загружайте в публичные ИИ-сервисы документы с паролями, персональными данными, медицинскими записями и коммерческой тайной без разрешения компании.
Сравнивайте ответы на одинаковых картинках
Русский интерфейс, местная оплата и привычный сервис могут быть удобны команде. Но они ничего не говорят о точности работы с изображениями. Если выбираете модель для такой задачи, проверяйте результат на одинаковом наборе файлов и с одинаковым запросом.
Возьмите по три чека, скриншота ошибок, схемы и рукописные заметки. В каждой группе добавьте чёткий файл, обычное рабочее фото и сложный вариант с бликом, мелким текстом или зачёркиванием. Это не рейтинг сервисов, а проверка ваших реальных сценариев.
| Критерий | Что проверять |
|---|---|
| Текст и числа | Верно ли прочитаны суммы, даты, коды и названия |
| Структура | Не перепутаны ли строки, блоки, стрелки и ветки |
| Следующий шаг | Безопасно ли выполнять совет |
| Неопределённость | Признала ли модель нечитаемый фрагмент |
| Ложные детали | Добавила ли модель то, чего нет на картинке |
Для типичной рабочей задачи выбирайте не самый уверенный ответ, а модель, которая реже добавляет несуществующие детали и прямо отмечает сомнения.
В Telegram-канале «Женя Pro Диджитал» можно взять идею для таблицы такого теста: сравнивайте не красоту ответа, а ошибки в важных полях.
Сегодня загрузите один рабочий скриншот и задайте три вопроса: что видно точно, что не читается и что проверить вручную. Этот запрос быстро превращает ИИ из уверенного рассказчика в полезного помощника.
Статья помогла?


