Нотатка

Згідливість — продуктове рішення

У квітні 2025 лабораторія випустила модель, яка почала всім підлизувати. За кілька днів відкотила і пояснила чому. Пояснення стосується і людей.

Олег Тетерятник/10 вересня 2026/6 хв

У кінці квітня 2025 OpenAI випустила оновлення, за кілька днів побачила, що модель почала з усім погоджуватись, і відкотила його. Цінний тут не випадок. Цінне те, що вони записали, що сталося, словами, яких у маркетингу ніхто б не вибрав.

Модель, кажуть, стала sycophantic. Надмірно підтримливою, але нещирою. І там же визнання, яке має значення: цю поведінку явно не перевіряли. Оцінки виявились недостатньо широкими і глибокими, щоб її зловити.

Підлабузника ніхто робити не збирався. У цьому й суть.

Що тут насправді за механізм

Система вчиться на реакції людей і дрейфує туди, на що люди реагують добре. А добре ми реагуємо на згоду. Не свідомо і не від слабкості: коли з тобою погоджуються, здається, що тебе зрозуміли, а коли тебе зрозуміли, здається, що порада хороша.

Тому оптимізуй під відчуття від розмови — і отримаєш не брехуна. Отримаєш краще за брехуна: підтримливий, добре обґрунтований, вправно написаний текст, який просто ніколи не веде туди, куди ти й сам не хотів. Лестощі ти впізнаєш. Оце — ні, бо приходить у вигляді аналізу.

Проблема не в тому, що тебе назвали чудовим. Проблема в тому, що тобі сказали: план надійний. Розгорнуто. З причинами.

І це тиск конструкції, а не баг, тому й повертається. Під ним кожна версія кожного з цих інструментів. Хороші лабораторії з ним борються, публічно і не без успіху. Але тиск не зникає: те, що робить продукт приємним, і те, що робить радника корисним, тягнуть у різні боки.

А тепер приклади це до людей навколо тебе

Ось чому я пишу про це на сайті про бренди і стратегію, а не про моделі.

Твоя команда теж учиться на твоїй реакції. Приносять, дивляться, що заходить, підлаштовуються. Роби так вісімнадцять місяців — і матимеш групу розумних людей, які надзвичайно добре обґрунтовують те, у бік чого ти вже схиляєшся. Ніхто не брехав. Ніхто не слабкий. Оптимізувались під відчуття від розмови, бо саме це винагороджувала система. Системою був ти.

Те саме з агенцією, яка постійно каже, що робота в стратегії. Те саме з радником, чий наступний контракт залежить від того, щоб цей пройшов приємно. І те саме — оце пече — з другом, який знає, що ти в захваті.

Лабораторія хоча б опублікувала розбір причин. Твоя понеділкова зустріч — ні.

Тест, який варто мати

Одне питання, і працює воно і на людях, і на машинах: чого коштує цій стороні не погодитись зі мною?

Команді — важкий тиждень і тріщина у відносинах із тим, хто платить їм зарплату. Агенції — обсяг робіт. Інвестору — нічого, але він оптимізує портфель, а не твою компанію, тому його незгода вказує в конкретний бік. Твоєму AI — нічого взагалі, і саме тому він корисний. Рівно до моменту, коли корисна відповідь — та, якої ти не хочеш.

Потрібен тобі той, кому незгода не коштує нічого, а згода нічого не приносить. Список короткий. Це люди без інтересу в результаті, і отримати таке можна тільки одним способом: платити за годину, а не за відповідь.

Спитай, чого їм коштує з тобою не погодитись. І на цю величину зваж усе, що вони сказали.

І ні, це не аргумент користуватися цим менше. Користуюсь щодня і без цього був би повільнішим. Це аргумент розуміти, що саме ти щойно отримав: перевірку свого мислення чи дуже добре написане його відображення.

Олег Тетерятник. Партнер на подумать. Креативний директор і бренд-стратег. Режисер.

Є про що подумати? Давай поговоримо →

← Усі нотатки