В главной роли
Наш замер

Насколько AI-иллюстрация похожа на ребёнка: замер по восьми стилям

Коротко. Мы прогнали одного и того же ребёнка через восемь стилей иллюстрации — 96 сцен — и измерили сходство лица прибором. Лучше всех держат лицо карандашный скетч (медиана 0,838) и билибинский стиль (0,783), хуже всех — реализм (0,496). У аниме и комикса измерить не удалось вовсе: детектор не находит лица на рисованном лице. Главный вывод не про стили, а про порог: привычные «0,85» взяты из сравнения фотографии с фотографией и к рисунку неприменимы.

Как мерили

Один ребёнок, один сюжет, по двенадцать сцен на каждый из восьми стилей. Каждая готовая сцена сравнивалась с портретом-образцом — тем самым, который конвейер строит из фотографии и подмешивает в каждую иллюстрацию. Число — косинусная близость векторов лица: единица означает то же самое лицо, ноль — ничего общего. Замер проведён 5 августа 2026 года на нашем конвейере, а не на демо.

Таблица: сходство лица по стилям

СтильМинМедианаМаксЗамечание
Карандаш / скетч0,5520,8380,936лучший результат
Народный / билибинский0,5910,7830,903
Сказочный мир0,1570,7110,841
3D-мультфильм0,5650,7060,848
Акварель0,3510,6040,816
Реализм0,3680,4960,674худший результат
Анимене измереноприбор не находит лицо
Комиксне измереноприбор не находит лицо

Двенадцать сцен на стиль, замер 5 августа 2026.

Два вывода, оба против интуиции

Первый: «нарисованнее» не значит «непохожее». Карандашный скетч и билибинский орнамент — самые условные из восьми стилей — держат лицо лучше акварели и 3D-мультфильма. Мы ожидали обратного и ошибались. Похоже, дело в том, что штриховой рисунок сохраняет геометрию лица, а мягкая заливка её растворяет.

Второй: порог, которым принято мерить, смотрит мимо. Планка 0,85, которую обычно называют «хорошим сходством», рассчитана на фотографию против фотографии. По ней не прошёл бы медианой ни один из восьми стилей, включая те, что глазами держат ребёнка безупречно. Мы опустили рабочий порог до 0,45 — не чтобы стало красивее в отчёте, а потому что прежний отбраковывал годные кадры и жёг деньги на перерисовку.

И честная дыра. Для аниме и комикса автоматического контроля у нас нет: детектор не видит лица на рисованном лице и возвращает «не измерено». В отчёте такая сцена помечена как прошедшая, но это значит «нечем проверить», а не «проверено и хорошо». Два стиля из восьми смотрит человек.

Сколько стоит один кадр

Отдельный замер, 27 июля 2026: одна и та же фотография ребёнка, 21 картинка, три поставщика. Цифры — то, что реально списалось со счёта, а не прайс с сайта.

МодельЗа кадрНа книгу (14 кадров)Сторона
grok-imagine-image-quality6,2 ₽87 ₽2048 px
gpt-image-1-mini через посредника10,1 ₽142 ₽1024 px
gemini-3.1-flash через посредника25,8 ₽361 ₽1024 px

Разница вчетверо между первой и последней строкой — и это при том, что дешёвая модель отдаёт вдвое большую сторону. Под печать 210×210 мм при 300 dpi нужно 2480 px: кадр на 1024 пришлось бы растягивать.

Что ломалось по дороге

Самое неожиданное открытие — запрет в промпте работает как подсказка. Провайдеры вклеивают отрицательный список в общий текст строкой «Avoid: …», и модель читает существительные из него как перечень предметов. Мы написали «без рамки, без паспарту, без белой кромки» — и получили серию кадров, аккуратно оформленных в паспарту. Слово, которым запрещаешь, надо убирать целиком, а не отрицать.

Второе: формулировка стиля описывала настроение вместо техники — и модель овеществляла носитель. Просьба про «мягкую акварель на бумаге» дала холст на стене внутри лесной сцены и белое паспарту по периметру зимней. Помогло не смягчение формулировки, а полное удаление всех упоминаний бумаги и холста с прямым утверждением, что живопись идёт до краёв кадра. После правки белого поля от края — ноль пикселей со всех четырёх сторон.

Наш вывод

Похожесть в персональной книге — не свойство модели, а свойство связки «стиль + порог + человек, который смотрит». Модель одна и та же, а разброс медиан между стилями — почти вдвое. Поэтому мы не обещаем «точное сходство»: мы называем стиль, показываем примеры и оставляем возможность перегенерировать сцену.

И держим у себя правило: цифру, которая нам не нравится, публикуем вместе с остальными. Замер, из которого выброшены неудобные строки, — это не замер, а реклама.

Проверить сходство на своём ребёнке можно бесплатно: превью собирается по фотографии до всякой оплаты.

Собрать превью по фото

Соседнее исследование: сравнение сервисов персональных книг — цены и возможности. Все наши данные — в разделе «Данные и исследования».

Вопросы и ответы

Что означает число похожести?+

Это косинусная близость векторов лица: единица — то же самое лицо, ноль — ничего общего. Прибор обучен сравнивать фотографию с фотографией, поэтому на рисунке его абсолютные значения ниже, чем ожидает интуиция. Сравнивать между собой стили по нему можно, а требовать «не ниже 0,85» — нельзя.

Почему у аниме и комикса стоит «не измерено», а не ноль?+

Детектор не находит на рисованном лице лица вовсе: у аниме в 11 сценах из 12, у комикса во всех 12. Это не плохой результат, а отсутствие результата, и мы различаем эти два случая в коде. Для двух стилей из восьми автоматического контроля у нас нет — там смотрит человек.

Вы публикуете стиль, у которого медиана 0,496. Зачем?+

Затем, что он такой. Реализм выпущен решением владельца с открытыми глазами: он знает цифру, она записана в наших решениях датой 5 августа. Скрыть её означало бы продавать вслепую человеку, который выберет именно этот стиль.

Можно ли повторить ваш замер?+

Да, если у вас есть свой конвейер: метод описан выше целиком — один ребёнок, один сюжет, по двенадцать сцен на стиль, сравнение каждой сцены с портретом-образцом. Наши абсолютные числа зависят от модели-детектора, поэтому воспроизводить стоит порядок стилей, а не значения.