ИИ, мне нечего надеть…

Открываешь шкаф, смотришь на него с тоской, закрываешь и надеваешь те же джинсы, что и вчера. Знакомо? Нейросети давно пора поручить то, чем раньше занималась мама с её сакраментальной фразой: «И куда ты в этом собралась?». Но если загрузить фото и спросить напрямую: «Ну как?», ИИ выдаст вежливое «Вау, очень стильно!» и продолжит бездушно льстить.

Таяна Деордица

профессор информатики Киевского национального технического университета

Проблема в том, что нейросеть – это не строгий критик из глянцевого журнала, а сверхвежливый генератор вероятностей. Она предсказывает следующее слово, опираясь на то, что уже написано. Если просить вердикт сразу, ей не на что опереться, кроме самого поверхностного и безопасного шаблона.

Одни и те же солнцезащитные очки с тонкой футболкой получают вердикт «тяжеловато», а с объёмным шарфом – «идеальный баланс». Модель оценивает не предмет, а пропорции кадра – крупная деталь на пустом фоне читается как перегрузка, а рядом с объёмом – уравновешивается. С цветом та же история, но уже другая ось оценки: яркая куртка с такими же яркими брюками получит вердикт «не идёт». Если попросить разобрать детали, окажется, что два насыщенных цвета спорят за роль доминанты – обоим нужен нейтральный партнёр, а не конкурент.

А вот третий случай – про практичность, а не эстетику: пара обуви, которая в магазине на нейтральном полу казалась идеальной, дома на фото рядом с юбкой миди выглядит грубовато. Дело не в паре как таковой, а в длине юбки – с другим низом та же обувь смотрится органично. Три разных провала – силуэт, цвет, соответствие всему комплекту – и три разных причины, но без особого пинка модель не станет искать ни одну из них, а просто поставит вам незачёт или пятёрку.

Еще в 2022 году исследователи Google описали технику Chain-of-Thought, то есть цепочку рассуждений: если заставить модель думать вслух шаг за шагом, качество ответа взлетает. Позже выяснилось, что для этого даже не нужны сложные инструкции, достаточно добавить в конце промпта волшебную фразу «Let’s think step by step».

Да, этот метод изобретали для математики и программирования, где есть четкое «правильно или неправильно». У моды нет жестких формул, иначе все ходили бы в одинаковых идеальных комбинезонах. Однако принцип тот же: рассуждение вслух заставляет модель вытащить на свет реальные критерии оценки до того, как она ляпнет очередное «Вам очень идёт!».

Чтобы заставить ИИ работать как надо, ваш запрос должен состоять из четырёх понятных элементов. Сначала задаем роль: «Ты – строгий стилист с десятилетним стажем». Это сразу отключает режим милого друга и включает профессиональный лексикон. Затем добавляем контекст: «Оцени образ для рабочей встречи в IT-компании со свободным дресс-кодом». Чем конкретнее ситуация, тем точнее разбор. Далее прописываем критерии, чтобы модель не упустила детали: «Разбери силуэт и пропорции, цветовые акценты, уместность и практичность». И в конце добавляем тот самый триггер: «Let’s think step by step».

Если и после всех рассуждений ответ кажется слишком гладким (модель всё же не хочет вас расстраивать), можно отправить следом ещё одну фразу: «Дай критическую оценку своему же разбору». Это включает механизм самокоррекции: алгоритм перечитывает собственные выводы и ищет в них слабые места. На практике это выглядит примерно так: там, где в первом ответе значилось «лоферы уместны», после критической проверки может появиться уточнение – «лоферы уместны для прогулки, но для встречи в офисе со свободным дресс-кодом лучше взять модель построже».

Ещё одна частая ошибка – просить оценку без фото, просто описав образ словами: «джинсы, белая рубашка, кеды, годится на встречу?» Модель честно оценит текст, но текст – не то же самое, что реальные пропорции и цвет на конкретной фигуре. Чтобы алгоритм не гадал на кофейной гуще, фотографируйтесь при дневном свете и на нейтральном фоне – резкие тени и пёстрые ковры сбивают модель с толку. Если сравниваете два комплекта, загружайте их в один чат и просите сравнить между собой напрямую, а не оценить каждый по отдельности, иначе нейросеть похвалит оба, лишь бы никого не обидеть, и вы не узнаете, какой оставить.

Этот подход работает не только дома перед зеркалом. Сделайте фото прямо в примерочной магазина, прогоните через ту же формулу – и вы узнаете, что пиджак вам велик в плечах, еще до того, как приложите банковскую карту к терминалу. 

Интервью с Таяной Деордицей можно посмотреть здесь