Фото на документы вслепую: мой квест с AI, кольцевой лампой и одним пятном
Меня очень вдохновляют возможности, которые дают нейросети. Недавно я прочитала статью о том, как кто-то сделал фото на документы дома с помощью искусственного интеллекта, и решила: «Почему бы не попробовать?». Расскажу пошагово, что я делала, учитывая один нюанс – я не вижу.
Для этого эксперимента у меня как раз появился просто бомбический штатив, который из 30 см. превращается в 180-сантиметровую конструкцию. Он устойчивый, к нему крепится кольцевая лампа, и у него даже есть пульт, с которым я, правда, пока не разобралась. Кстати, лайфхак: кольцевая лампа прекрасно работает от пауэрбанка. Это удобно, если вы в «полевых условиях» или розетка просто далеко.
Шаг 1. Ревизия «богатства». Что имеем?
Я не стала сразу фотографироваться. Сначала я пришла к AI с запросом: «Помоги. Вот что у меня есть». И честно показала весь свой арсенал:
- одна кольцевая лампа (та самая, на штативе);
- около 10 мелких, но ярких светильников (без рассеивателей);
- обычная домашняя стена с фактурной штукатуркой.



Сразу про стену: для AI-обработки она оказалась отличным вариантом. Нет смысла искать идеально белый фон, если программа все равно будет его полностью заменять. Наша задача была – просто получить четкий кадр. Так что обычная домашняя стена – это нормально. А вот со светом все оказалось сложнее. Моя первая мысль была: «Включу все!». Но AI тут же ее раскритиковал. Оказалось, эти 10 мелких ламп – «прожекторы», которые создадут жесткие тени под носом и глазами, превратят лицо в маску и добавят усталости. Решили: используем только кольцевую лампу. Все остальное – выключить.
Шаг 2. Фотосессия по инструкции: «Шаг от стены, подбородок выше»
Это была самая методичная часть. Я не просто щелкала селфи. Я действовала пошагово, отправляя AI фото на каждом этапе.
Итерация 1 (Оценка): Сначала я прислала фото включенной лампы и фото стены, чтобы AI оценил «сцену».
Итерация 2 (Первый кадр): Сделала первое фото. Вердикт: «Плохо. Ты стоишь вплотную к стене, тень за тобой слишком резкая. И выключи верхний свет в комнате, он дает лишние блики».
Итерация 3 (Свет лучше): Ок. Отошла от стены, погасила люстру. Новое фото. Вердикт: «Свет – отлично! Теперь ровно. Но... ты опустила подбородок. Видимо, по привычке прислушиваешься к телефону. Держи голову прямо, как будто смотришь вдаль».
Кстати, AI мне очень помог, напомнив про функцию в телефоне. Современные смартфоны с «говорящими» программами (VoiceOver или TalkBack) умеют озвучивать, где находится лицо в кадре: «лицо по центру», «лицо вверху справа» и так далее. Это невероятно удобно, чтобы разместиться правильно.
Мой процесс съемки выглядел так: я вставала, по голосовой подсказке ловила «лицо по центру», а потом ставила таймер на 10 секунд и отходила в позу.
Итерация 4 (Финал): Я выровнялась, приподняла подбородок, поймала центр и сделала финальный кадр. AI сказал: «Вот. Это то, что нужно. Идеальная база для обработки».
Шаг 3. Неловкий момент (то самое пятно)
А теперь неловкий, но честный момент. Уже после того, как вся работа была сделана, я решила проанализировать все исходники для этого кейса. Отправила то самое «идеальное» базовое фото нейросети, чтобы получить описание, и она мне честно сообщила: «На женщине бежевая кофта с пятном».
Отлично. Но я решила ничего не корректировать. Во-первых, это честная работа, как она есть. А во-вторых, будем откровенны, одежда на сгенерированной фотографии все равно будет заменена. Так что оставляем как есть.
Шаг 4. Промпты и «переодевание»
Имея на руках снимок с идеальным светом, но сомнительной кофтой, мы перешли к генерации. Сначала я использовала промпт, который мы составили с Gemini, чтобы просто сделать из этого «фото на документы».
Промпт 1 (Базовый):
«Привет! Возьми эту фотографию и сделай из нее фото на документы (формат 3х4 см).
Главная задача: Сохранить 100% мою узнаваемость.
Что нужно сделать:
Фон: Полностью замени фон за мной на однородный светло-серый (или белый). Убери текстуру стены.
Кадрирование: Обрежь фото так, чтобы в кадре были только голова и плечи (стандартное кадрирование для документов).
Лицо: Не меняй черты лица! Не трогай форму глаз, носа, губ, овал лица. Оставь мою прическу и макияж как есть.
Свет: Только если на лице есть мелкие, случайные тени (например, под подбородком), очень аккуратно их смягчи. Не делай лицо «пластиковым» или «плоским».
Запрещено: Изменять черты лица, ретушировать кожу, менять цвет волос или одежды».
Результат получился хороший. Фон заменился, свет выровнялся. Но кофта-то с пятном осталась. Поэтому мы написали второй, более «продвинутый» промт. Если уж AI может фон менять, пусть заодно и «переоденет».
Промпт 2 (С переодеванием):
«Создай фото на документы (формат 3х4 см).
Главная задача: Сохранить 100% узнаваемость женщины.
Что нужно сделать:
Фон: Полностью замени фон за мной на однородный белый. Убери текстуру стены.
Кадрирование: Обрежь фото так, чтобы в кадре были только голова и плечи (стандартное кадрирование для документов).
Лицо: Не меняй черты лица! Не трогай форму глаз, носа, губ, овал лица. Оставь прическу и макияж как есть. Переодень меня в классическую белую рубашку.
Свет: Только если на лице есть мелкие, случайные тени (например, под подбородком), очень аккуратно их смягчи. Не делай лицо «пластиковым» или «плоским».
Запрещено: Изменять черты лица, ретушировать кожу, менять цвет волос».
Шаг 5. Двойной контроль: AI + Человек
Нейросеть выдала мне несколько вариантов. Тут начался мой личный «ОТК» (Отдел технического контроля).
Этап 1 (AI-контроль): Я отправила все 5 генераций обратно Gemini: «Анализируй. Где я – это я? Где нет искажений? Какая самая реалистичная?» Мы выбрали лучшую (Фото 2).





Этап 2 (Человеческий контроль): Затем – зрячим друзьям. Вердикт: «Это ты. Выглядит как из фотосалона». Но лучшим комплиментом была реакция моего iPhone. Он сам опознал меня на сгенерированных фото и в альбоме «Люди» пометил их «Возможно, Ольга». Машина узнала меня в творении другой машины. Узнаваемость 100% – миссия выполнена.
Шаг 6. Финальный штрих: водяной знак
Осталась мелочь. Google ставит на все генерации свою метку – маленькую светящуюся звездочку в правом нижнем углу.


Это не проблема. AI подсказал два простых варианта:
- Просто обрезать (Crop): Самый легкий путь. Знак в самом углу на белом фоне. Любой редактор на телефоне «откусит» этот уголок за секунду.
- «Волшебный ластик»: В том же Google Фото или Snapseed просто «замазать» его. Он исчезнет без следа.
Итог:
В статье, которая меня вдохновила, автор сомневался, стоит ли нести такое фото в паспортный стол. Я скажу так: для любого пропуска, студенческого, анкеты или визы – это идеальный вариант.
А если аккуратно убрать водяной знак... Кто вообще догадается, что вы для этого фото даже из дома не выходили?
