Два человека с одинаковой подпиской получают от Claude очень разный результат. Один говорит «пишет воду», другой закрывает моделью половину рабочих задач. Anthropic решила измерить, в чём разница, и разобрала почти десять тысяч диалогов: не «о чём люди спрашивают», а как они себя ведут в переписке.
Что именно измеряли
За основу взяли фреймворк ИИ-грамотности с 24 признаками грамотной работы с моделью. Одиннадцать из них видно прямо в переписке: уточнил ли человек задачу, задал ли формат, привёл ли пример, проверил ли факты, оспорил ли логику ответа. Остальные тринадцать происходят вне чата и подсчёту не поддаются. По наблюдаемым и построили индекс.
Главный вывод: решает диалог, а не первый запрос
Сильнее всего с качеством работы связана одна привычка — не принимать первый ответ. Такие диалоги составили около 86% выборки, и в них было примерно вдвое больше остальных признаков грамотности, чем в переписках по схеме «спросил — забрал — ушёл». Разрыв особенно велик там, где человек просит объяснить ход рассуждений (примерно в пять раз чаще) и замечает, что модели не хватило вводных (примерно вчетверо чаще).
Практический смысл простой: перестаньте считать первый ответ результатом. «Второй абзац звучит как реклама, перепиши его сухо», «ты предположил, что бюджет годовой, — он квартальный, пересчитай» — вот из таких реплик и складывается разница между «пишет воду» и рабочим инструментом.
Ловушка красивого результата
Второй вывод неприятнее. Когда Claude делает не текст в чате, а готовый артефакт — приложение, документ, интерактивную таблицу, — люди лучше ставят задачу: чаще проговаривают цель, задают формат, дают примеры. И при этом реже проверяют факты, реже замечают недостающий контекст и реже просят объяснить логику. Чем аккуратнее выглядит результат, тем меньше желания его перепроверять.
Отсюда правило: чем красивее вышло, тем внимательнее смотрите. Считает — посчитайте один пример руками и сравните. Есть цифра — спросите, откуда она. Подробнее — в статье про артефакты.
Третья находка: почти никто не задаёт правила игры
Только примерно в трети диалогов человек вообще говорит Claude, как с ним работать. А это самая дешёвая настройка из всех: одна строка в начале меняет тон всей переписки. Попробуйте начинать так: «Спорь, если моя посылка неверна. Сначала покажи ход рассуждений, потом вывод. Отдельно перечисли то, в чём не уверен».
Совет
Три привычки из исследования складываются в короткий чек-лист на каждый рабочий диалог: задайте правила игры первой репликой, не забирайте первый ответ, а самый гладкий результат проверьте руками хотя бы на одном примере. Если вы работаете в Проекте, эти правила можно один раз положить в инструкции проекта — и не повторять их каждый день.
Где купить Claude
Подписку Claude из России напрямую не оплатить: карты российских банков на сайте Anthropic не проходят. У нас в каталоге Claude Pro (2 090 ₽/мес), Max 5x (11 010 ₽/мес), Max 20x (22 010 ₽/мес) и пополнение API от $20 — оплата картой РФ или через СБП, поддержка на русском.
Обсуждение
0 комментариев