EverProduct
Нейросети

Этап 03 · Доверие и проверка

Как проверять, не теряя смысла

Проверять всё — значит обнулить выигрыш; не проверять — однажды дорого заплатить. Выход в том, чтобы проверять не ответ, а те несколько точек внутри него, которые вообще проверяемы.

Приходит ответ: две страницы, разложено по полочкам, всюду правдоподобно. Что дальше? Прочитать это критически от начала до конца — почти столько же времени, сколько написать самому, то есть весь выигрыш обнуляется. Не проверять — работает ровно до того дня, когда не сработает.

Большинство решает эту дилемму на ощупь: проверяют то, что зацепило глаз, и доверяют всему гладкому. Есть способ лучше, и занимает он секунд тридцать.

Ответ — это не одно утверждение

Вот движение, на котором держится вся статья.

Ответ на две страницы ощущается единым объектом, которому либо доверяешь, либо нет. Это не так. Это связка из нескольких десятков утверждений с совершенно разным риском: общие рассуждения, которые ты и сам оцениваешь по ходу чтения; структура, которая либо полезна, либо нет; и небольшое число твёрдых конкретных атомов — цифра, дата, имя, ссылка, параметр функции, заявленная причинность.

Практически весь риск сосредоточен в этих атомах, и их обычно от пяти до десяти.

Проверяй не ответ, а его проверяемые точки.

Так расплывчатая изматывающая задача превращается в конкретную и быструю: вытащить конкретику, проверить её, а остальное прочитать на здравый смысл — как читаешь записку от коллеги.

Атомы, которые стоит выдёргивать, примерно по убыванию опасности: числа и статистика; даты; имена людей, продуктов, законов, дел; дословные цитаты; ссылки, источники, пути к файлам; детали API, параметры, версии, команды; превосходные степени и абсолюты («единственный», «всегда», «лучший»); утверждения о причинности («потому что», «это приводит к»). Всё остальное в тексте либо проверяется обычным чтением, либо не проверяется вовсе.

Лестница, снизу вверх по цене

Читай как эксперт, если ты эксперт. В своей области это почти бесплатно — ошибки выпрыгивают сами. В незнакомой то же самое чтение не даёт ничего, и никакая старательность этого не меняет. Это опять правило прошлой статьи: не делегируй то, что не сможешь оценить.

Прощупай почву. Прежде чем доверять модели в незнакомой теме, потрать один вопрос на выяснение, толстый там рельеф или тонкий: спроси про то, чего не существует, — выдуманный термин, правдоподобную книгу, несуществующий регламент. Если она уверенно начнёт рассказывать, ты узнал, что земля здесь сегодня тонкая, и всё остальное в этом разговоре заслуживает большего подозрения. Тридцать секунд, и вся сессия перекалибрована.

Требуй прослеживаемости. Когда ответ строится на твоём материале: «на каждое утверждение приведи точное предложение из источника; если такого предложения нет, напиши „нет в источнике“». Это превращает проверку в сверку — ты сличаешь цитаты с документом вместо того, чтобы оценивать утверждения из воздуха.

Прогони дважды на чистом столе. Задай тот же вопрос в новом чате и сравни. Расхождение на конкретном атоме — сильный сигнал, что почва там тонкая. Совпадение доказывает меньше, чем кажется (оба прогона могут скатиться в одну и ту же натоптанную неправильную лощину), но как дешёвый фильтр работает отлично.

Выведи назад. «Покажи путь от данных к этому выводу по шагам». Восстановленное рассуждение проверяемо так, как готовый вердикт непроверяем, и дыры в нём обычно видны даже неспециалисту.

Прицепи внешний сигнал. Запусти код. Открой ссылку. Пересчитай число в таблице. Найди дело. Вот это настоящая проверка; всё, что выше по лестнице, — сортировка, которая говорит, куда её тратить.

Спроси человека там, где дорого, необратимо или узкоспециально.

Что проверкой не является

Стоит перечислить прямо, потому что всё это ощущается проверкой:

  • Спросить у той же модели «ты уверена?» — это приманка для угодливости, а не проверка.
  • Попросить источник и не открыть его. Непройденная ссылка — украшение.
  • Переспросить в том же чате: первый ответ лежит на столе и тянет второй к себе.
  • Уверенный тон, аккуратное оформление, осторожные оговорки, названный процент уверенности. Всё это стиль вывода, и ни одно надёжно не связано с правотой.

Общий принцип из четвёртой статьи держится: проверка, оставшаяся внутри контура, — не проверка.

Ловушка старше, чем ИИ

Склонность недопроверять — не изъян характера и не новость. Психологи, изучавшие пилотов и операторов, назвали это предвзятостью автоматизации ещё в 1990-х: человек, контролирующий автоматическую систему, принимает её вывод охотнее, чем принял бы то же утверждение от человека, и — более острый результат — перестаёт замечать ошибки, которые поймал бы, работая сам. Группа Линды Скитки показала оба эффекта экспериментально; Раджа Парасураман и Виктор Райли в 1997-м разложили всю область на «использование, злоупотребление, неиспользование, извращение».

Отсюда два вывода. Склонность нормальна, и лечится она привычкой, а не силой воли, — этой лестницей. И риск максимален ровно там, где система обычно права: после двадцатого верного ответа проверять двадцать первый кажется нелепым. Это ощущение и есть предвзятость, а не свидетельство.

Не перепроверяй тоже

Обратный провал реален и у аккуратных людей встречается чаще. Если допрашивать всё подряд, ты нанял помощника и стал его штатным аудитором. Экономии нет, и смысла в инструменте тоже.

Сортируй по цене ошибки, ровно как в четвёртой статье. Мозговые штурмы, черновики, объяснения, которые ты всё равно проверишь практикой, код, который сейчас запустишь, — не проверяй, работай: ошибки всплывут сами и будут стоить секунд. Цифры в документе, ссылки в публикации, всё юридическое, медицинское и финансовое, всё необратимое, всё, что увидит клиент, — проверяй каждый атом, каждый раз.

И заметь, по какую сторону этой черты лежит основная масса твоей работы. У большинства — по дешёвой, а значит, правильный объём проверки для большей части их работы с ИИ близок к нулю, и вся эта дисциплина существует ради небольшого остатка.

Бонус прямо из «Как учиться»: когда ты проверяешь, восстанавливая рассуждение сам, ты занимаешься извлечением. Проверка хорошего объяснения — один из немногих случаев, когда двойная трата времени реально окупается: получаешь и ответ, и усвоение.

На практике

Сначала выдёргивай атомы. Числа, даты, имена, цитаты, ссылки, параметры, абсолюты, причинность. Пять-десять на ответ — вот и весь список проверки.

Незнакомую область прощупывай до доверия. Спроси про то, чего не существует.

Заставляй цитировать источник всякий раз, когда ответ построен на твоём материале.

Сравнивай два чистых прогона, когда ставки средние, а тема узкая.

Никогда не проверяй внутри того же разговора. Внешний сигнал или ничего.

Решай по цене ошибки и прими, что большая часть работы не требует проверки вообще.

Проверь себя

Закрой статью и ответь своими словами:

  1. Почему «можно ли доверять этому ответу» — неправильный вопрос и что вместо него?
  2. Какие атомы несут почти весь риск и сколько их примерно в обычном ответе?
  3. Как работает приём «прощупать почву» и что именно он тебе сообщает?
  4. Что меняет в природе проверки требование точных цитат?
  5. Что означает расхождение двух чистых прогонов — и чего не означает совпадение?
  6. Что такое предвзятость автоматизации и почему риск максимален после длинной серии верных ответов?
  7. Чем плоха перепроверка и как решать, куда тратить усилие?

Коротко

  • Ответ — это связка: в основном читаемые рассуждения плюс пять-десять твёрдых атомов (числа, даты, имена, цитаты, ссылки, параметры, абсолюты, причинность). Риск живёт в атомах.
  • Лестница снизу вверх: экспертное чтение, прощупывание почвы несуществующим, требование точных цитат, сравнение двух чистых прогонов, обратный вывод, настоящий внешний сигнал.
  • Не проверка: «ты уверена?», неоткрытые источники, переспрашивание в том же чате, уверенный тон и оформление.
  • Предвзятость автоматизации (Скитка и др.; Парасураман и Райли, 1997) на десятилетия старше ИИ: надзирающий за автоматикой недопроверяет и перестаёт ловить ошибки, которые заметил бы сам. Лечится привычкой, а не волей.
  • Риск максимален после длинной серии верных ответов — именно тогда, когда проверять кажется нелепым.
  • Перепроверка обнуляет инструмент. Сортируй по цене ошибки; большинству повседневных задач проверка не нужна.
  • Проверка через самостоятельное восстановление рассуждения заодно работает как извлечение.
  • Проверяй не ответ, а его проверяемые точки.