Заходишь в кафе, смотришь на меню с бургерами и сэндвичами — и что-то не так. Сыр слишком идеально тянется, форма шариков мороженого слишком правильная, креветки выглядят так, будто их выращивали в лаборатории. Это не паранойя. Это генеративный ИИ, который добрался до ресторанного бизнеса и принёс с собой узнаваемую, почти клиническую эстетику фальши.
Объяснение простое и одновременно тревожное. Модели, создающие изображения — те же технологии за ChatGPT и Midjourney — обучены на огромных массивах данных и находят в них усреднённые паттерны. Alex Lisle, технический директор компании Reality Defender, занимающейся детекцией ИИ-контента, сравнивает это с попыткой инопланетянина приготовить пиццу, не понимая её сути. Львиная доля рекламных фотографий еды в интернете — это меню сетевых закусочных вроде Chili’s из середины 2010-х. Модель училась именно на этом корпусе, и теперь любой сгенерированный бургер тянет в ту же сторону: глянцевый, симметричный, немного ненастоящий.
Проблема усугубляется по спирали. Когда AI-сгенерированные изображения сами попадают обратно в обучающие датасеты — а это неизбежно при таких объёмах данных — эстетика однообразия закрепляется ещё сильнее. Учёные называют крайнюю форму этого явления model collapse: если скармливать модели её же собственные результаты бесконечно, качество деградирует до бессмысленности. Lisle сравнивает это с коровьим бешенством — вырождение от самопоедания. То, что происходит с меню — версия помягче, конвергенция: контент не разрушается полностью, но неумолимо стягивается к одному усреднённому шаблону.
Эффект усиливается, если владелец кафе редактирует картинку через ChatGPT раз за разом, меняя цену или название блюда. Пользователь под ником Labtec провёл эксперимент — отредактировал одно и то же меню сто раз подряд, и с каждой правкой еда становилась всё более округлой и гладкой, теряя связь с реальностью. TechCrunch повторили опыт и получили тот же результат.
Здесь есть научное объяснение реакции отторжения — исследователи из университета Дуйсбург-Эссен зафиксировали классический эффект uncanny valley: изображения еды, которые выглядят почти реалистично, вызывают больше дискомфорта, чем откровенно нарисованные. Мозг считывает подвох раньше, чем сознание успевает его сформулировать.
За гастрономическим курьёзом прячется вопрос серьёзнее. Lisle напоминает: видео и фото десятилетиями считались золотым стандартом доказательств, вплоть до судебных заседаний, где записанное на камеру признание — весомый аргумент. Мир, где любое изображение может оказаться синтетическим, меняет эту логику необратимо. Меню с неестественно идеальным бургером — безобидный побочный эффект. Но привычка не доверять глазам однажды коснётся вещей куда серьёзнее заказа обеда.
Во что углубиться:
- Model collapse в машинном обучении: что происходит, когда нейросети обучаются на собственных сгенерированных данных
- Эффект uncanny valley: откуда взялась эта психологическая теория и почему она применима не только к роботам, но и к изображениям
- Стартапы по детекции AI-контента: какие технологии сегодня умеют отличать сгенерированное изображение от реального
