Один и тот же документ можно отдать ChatGPT двумя способами: прикрепить файл кнопкой со скрепкой или скопировать текст прямо в поле ввода. Результат получается разный, и чаще всего люди выбирают наугад. Разбираем, когда в ChatGPT загружать файл, а когда вставлять текст в чат, что модель делает с тем и другим и почему длинный документ иногда отвечает хуже короткого куска.
Чем загрузка файла отличается от вставки текста
Вставленный текст становится частью вашего сообщения. Модель видит его целиком и ровно в том виде, в каком вы его положили. Ничего не теряется, но всё это занимает место в окне диалога: чем длиннее вставка, тем меньше остаётся на дальнейший разговор.
Файл обрабатывается отдельно. Из документа достаётся текст, таблица уходит в инструмент анализа данных, где ChatGPT пишет и выполняет код по вашим строкам и столбцам. В списке возможностей моделей загрузка файлов и анализ данных стоят отдельными пунктами - это разные механизмы, а не одна кнопка.
Отсюда главное различие. Короткий кусок текста модель прочитает дословно. Длинный файл она, по нашему опыту, скорее просматривает по нужным местам, чем зачитывает от корки до корки, и на вопрос "что написано в пункте 7.3" отвечает точнее, чем на "перескажи всё".
Логика простая, и OpenAI держится её с самых первых версий справки: небольшой объём и разовая задача - текст в запрос, крупный массив и работа вдолгую - файл.
Какие файлы принимает ChatGPT и какие ограничения по размеру
В чат можно положить документы, таблицы, презентации и картинки. Ограничения на момент публикации такие:
- жёсткий потолок 512 МБ на файл;
- текстовые и документные файлы - до 2 миллионов токенов на файл, на таблицы это ограничение не распространяется;
- CSV и электронные таблицы - примерно до 50 МБ, точная цифра зависит от того, насколько тяжёлые у вас строки;
- изображения - до 20 МБ на картинку.
Цифры OpenAI периодически меняет, так что если файл не грузится, а по вашим прикидкам должен - сверьтесь со справкой, а не с этой статьёй. Загруженные и созданные файлы попадают в библиотеку, откуда их можно вставить в новый чат без повторной загрузки: как это устроено, разбирали в статье про файлы и библиотеку ChatGPT. В временном чате файл не сохраняется вообще.
Ещё одна мелочь, на которой спотыкаются: не все модели одинаково работают с вложениями. Рассуждающие модели файлы принимают, но у отдельных из них список возможностей урезан - подробности в разборе про файлы в рассуждающих моделях. Если вложение не прикрепляется, первым делом переключите модель.
Когда файл выигрывает
Файл почти всегда лучше в четырёх случаях.
Документ длинный. Договор на сорок страниц, отчёт, методичка. Вставлять такое руками бессмысленно: вы забьёте окно диалога одним сообщением и потеряете возможность нормально переспрашивать.
Данные табличные. Выгрузка продаж, список заказов, бюджет. При загрузке файла ChatGPT считает по строкам кодом, а не прикидывает суммы в уме. Вставленная в чат таблица теряет структуру и превращается в кашу из чисел. Про работу с таблицами отдельно писали в материале про ChatGPT в Excel и Google Таблицах.
Важно оформление. Скан, PDF с колонками, презентация. Копипаст ломает порядок абзацев, а из файла модель достаёт текст вместе со структурой. Готовые формулировки вопросов к PDF собраны в статье про ChatGPT и PDF.
Документ понадобится ещё раз. Один раз загрузили, дальше берёте из библиотеки и не ищете исходник по папкам.
Когда файл мешает
Текстом быстрее и точнее, если фрагмент небольшой: абзац из письма, пара пунктов договора, кусок кода, сообщение об ошибке. Такой кусок модель прочитает дословно, и вы точно знаете, что она видела.
Файл мешает и тогда, когда вопрос касается одного места в большом документе. Вы загружаете сто страниц ради одного абзаца, а модель ищет по всему объёму и приносит соседний похожий пункт. Проще вырезать нужную страницу и вставить её текстом.
Третий случай - правка текста по кругу: там нужна дословность и быстрые итерации.
Как формулировать запрос к загруженному файлу
Само по себе вложение задачу не ставит. Работают три вещи.
- Скажите, что это за документ. "Это договор аренды" или "это выгрузка заказов за июль, колонка D - сумма". Модель перестанет угадывать назначение колонок.
- Назовите место. "Раздел 4", "страницы 12-15", "лист Сводка". Указание на конкретный кусок работает лучше, чем просьба посмотреть везде.
- Попросите показать основание. "Процитируй пункт, на котором строится вывод" или "покажи формулу, по которой посчитал". Так вы сразу видите, читала модель нужное место или придумала.
Плохой запрос: "проанализируй файл". Хороший: "это договор подряда, выпиши мои обязанности и сроки из раздела 3, каждый пункт с цитатой".
Что делать, если ChatGPT видит не весь документ
Типичная жалоба: в файле есть таблица на 30-й странице, а модель уверяет, что её нет. Порядок действий такой.
- Проверьте, что документ не картинка. Скан без распознанного текста читается как изображение, и мелкие цифры в нём теряются.
- Спросите про конкретное место с цитатой, а не "есть ли там таблица".
- Разрежьте документ на части и загрузите нужный кусок отдельно.
- Таблицу выгрузите в CSV или XLSX вместо PDF - тогда включится анализ данных.
- Начните новый чат. Если диалог длинный, начало разговора вытесняется, и файл из первого сообщения фактически забывается.
И общее правило: чем важнее ответ, тем полезнее просить цитату. Ошибка "модель не увидела кусок" и ошибка "модель придумала кусок" выглядят одинаково, а цитата разводит их сразу.
Где купить ChatGPT из России
Загрузка файлов, анализ данных и библиотека нормально работают на платных тарифах, а оплатить их российской картой на сайте OpenAI не выйдет. Подписку оформляем на вашу почту: ChatGPT Go, Plus, Pro 5x и Pro 20x, плюс пополнение API. Оплата картой РФ или СБП, выдача в день заказа.
Обсуждение
0 комментариев