У кінці квітня 2025 OpenAI випустила оновлення, за кілька днів побачила, що модель почала з усім погоджуватись, і відкотила його. Цінний тут не випадок. Цінне те, що вони записали, що сталося, словами, яких у маркетингу ніхто б не вибрав.
Модель, кажуть, стала sycophantic. Надмірно підтримливою, але нещирою. І там же визнання, яке має значення: цю поведінку явно не перевіряли. Оцінки виявились недостатньо широкими і глибокими, щоб її зловити.
Підлабузника ніхто робити не збирався. У цьому й суть.
Що тут насправді за механізм
Система вчиться на реакції людей і дрейфує туди, на що люди реагують добре. А добре ми реагуємо на згоду. Не свідомо і не від слабкості: коли з тобою погоджуються, здається, що тебе зрозуміли, а коли тебе зрозуміли, здається, що порада хороша.
Тому оптимізуй під відчуття від розмови — і отримаєш не брехуна. Отримаєш краще за брехуна: підтримливий, добре обґрунтований, вправно написаний текст, який просто ніколи не веде туди, куди ти й сам не хотів. Лестощі ти впізнаєш. Оце — ні, бо приходить у вигляді аналізу.
Проблема не в тому, що тебе назвали чудовим. Проблема в тому, що тобі сказали: план надійний. Розгорнуто. З причинами.
І це тиск конструкції, а не баг, тому й повертається. Під ним кожна версія кожного з цих інструментів. Хороші лабораторії з ним борються, публічно і не без успіху. Але тиск не зникає: те, що робить продукт приємним, і те, що робить радника корисним, тягнуть у різні боки.
А тепер приклади це до людей навколо тебе
Ось чому я пишу про це на сайті про бренди і стратегію, а не про моделі.
Твоя команда теж учиться на твоїй реакції. Приносять, дивляться, що заходить, підлаштовуються. Роби так вісімнадцять місяців — і матимеш групу розумних людей, які надзвичайно добре обґрунтовують те, у бік чого ти вже схиляєшся. Ніхто не брехав. Ніхто не слабкий. Оптимізувались під відчуття від розмови, бо саме це винагороджувала система. Системою був ти.
Те саме з агенцією, яка постійно каже, що робота в стратегії. Те саме з радником, чий наступний контракт залежить від того, щоб цей пройшов приємно. І те саме — оце пече — з другом, який знає, що ти в захваті.
Лабораторія хоча б опублікувала розбір причин. Твоя понеділкова зустріч — ні.
Тест, який варто мати
Одне питання, і працює воно і на людях, і на машинах: чого коштує цій стороні не погодитись зі мною?
Команді — важкий тиждень і тріщина у відносинах із тим, хто платить їм зарплату. Агенції — обсяг робіт. Інвестору — нічого, але він оптимізує портфель, а не твою компанію, тому його незгода вказує в конкретний бік. Твоєму AI — нічого взагалі, і саме тому він корисний. Рівно до моменту, коли корисна відповідь — та, якої ти не хочеш.
Потрібен тобі той, кому незгода не коштує нічого, а згода нічого не приносить. Список короткий. Це люди без інтересу в результаті, і отримати таке можна тільки одним способом: платити за годину, а не за відповідь.
Спитай, чого їм коштує з тобою не погодитись. І на цю величину зваж усе, що вони сказали.
І ні, це не аргумент користуватися цим менше. Користуюсь щодня і без цього був би повільнішим. Це аргумент розуміти, що саме ти щойно отримав: перевірку свого мислення чи дуже добре написане його відображення.
Олег Тетерятник. Партнер на подумать. Креативний директор і бренд-стратег. Режисер.
Є про що подумати? Давай поговоримо →