Насколько AI-иллюстрация похожа на ребёнка: замер по восьми стилям
Коротко. Мы прогнали одного и того же ребёнка через восемь стилей иллюстрации — 96 сцен — и измерили сходство лица прибором. Лучше всех держат лицо карандашный скетч (медиана 0,838) и билибинский стиль (0,783), хуже всех — реализм (0,496). У аниме и комикса измерить не удалось вовсе: детектор не находит лица на рисованном лице. Главный вывод не про стили, а про порог: привычные «0,85» взяты из сравнения фотографии с фотографией и к рисунку неприменимы.
Как мерили
Один ребёнок, один сюжет, по двенадцать сцен на каждый из восьми стилей. Каждая готовая сцена сравнивалась с портретом-образцом — тем самым, который конвейер строит из фотографии и подмешивает в каждую иллюстрацию. Число — косинусная близость векторов лица: единица означает то же самое лицо, ноль — ничего общего. Замер проведён 5 августа 2026 года на нашем конвейере, а не на демо.
Таблица: сходство лица по стилям
| Стиль | Мин | Медиана | Макс | Замечание |
|---|---|---|---|---|
| Карандаш / скетч | 0,552 | 0,838 | 0,936 | лучший результат |
| Народный / билибинский | 0,591 | 0,783 | 0,903 | |
| Сказочный мир | 0,157 | 0,711 | 0,841 | |
| 3D-мультфильм | 0,565 | 0,706 | 0,848 | |
| Акварель | 0,351 | 0,604 | 0,816 | |
| Реализм | 0,368 | 0,496 | 0,674 | худший результат |
| Аниме | — | не измерено | — | прибор не находит лицо |
| Комикс | — | не измерено | — | прибор не находит лицо |
Двенадцать сцен на стиль, замер 5 августа 2026.
Два вывода, оба против интуиции
Первый: «нарисованнее» не значит «непохожее». Карандашный скетч и билибинский орнамент — самые условные из восьми стилей — держат лицо лучше акварели и 3D-мультфильма. Мы ожидали обратного и ошибались. Похоже, дело в том, что штриховой рисунок сохраняет геометрию лица, а мягкая заливка её растворяет.
Второй: порог, которым принято мерить, смотрит мимо. Планка 0,85, которую обычно называют «хорошим сходством», рассчитана на фотографию против фотографии. По ней не прошёл бы медианой ни один из восьми стилей, включая те, что глазами держат ребёнка безупречно. Мы опустили рабочий порог до 0,45 — не чтобы стало красивее в отчёте, а потому что прежний отбраковывал годные кадры и жёг деньги на перерисовку.
И честная дыра. Для аниме и комикса автоматического контроля у нас нет: детектор не видит лица на рисованном лице и возвращает «не измерено». В отчёте такая сцена помечена как прошедшая, но это значит «нечем проверить», а не «проверено и хорошо». Два стиля из восьми смотрит человек.
Сколько стоит один кадр
Отдельный замер, 27 июля 2026: одна и та же фотография ребёнка, 21 картинка, три поставщика. Цифры — то, что реально списалось со счёта, а не прайс с сайта.
| Модель | За кадр | На книгу (14 кадров) | Сторона |
|---|---|---|---|
| grok-imagine-image-quality | 6,2 ₽ | 87 ₽ | 2048 px |
| gpt-image-1-mini через посредника | 10,1 ₽ | 142 ₽ | 1024 px |
| gemini-3.1-flash через посредника | 25,8 ₽ | 361 ₽ | 1024 px |
Разница вчетверо между первой и последней строкой — и это при том, что дешёвая модель отдаёт вдвое большую сторону. Под печать 210×210 мм при 300 dpi нужно 2480 px: кадр на 1024 пришлось бы растягивать.
Что ломалось по дороге
Самое неожиданное открытие — запрет в промпте работает как подсказка. Провайдеры вклеивают отрицательный список в общий текст строкой «Avoid: …», и модель читает существительные из него как перечень предметов. Мы написали «без рамки, без паспарту, без белой кромки» — и получили серию кадров, аккуратно оформленных в паспарту. Слово, которым запрещаешь, надо убирать целиком, а не отрицать.
Второе: формулировка стиля описывала настроение вместо техники — и модель овеществляла носитель. Просьба про «мягкую акварель на бумаге» дала холст на стене внутри лесной сцены и белое паспарту по периметру зимней. Помогло не смягчение формулировки, а полное удаление всех упоминаний бумаги и холста с прямым утверждением, что живопись идёт до краёв кадра. После правки белого поля от края — ноль пикселей со всех четырёх сторон.
Наш вывод
Похожесть в персональной книге — не свойство модели, а свойство связки «стиль + порог + человек, который смотрит». Модель одна и та же, а разброс медиан между стилями — почти вдвое. Поэтому мы не обещаем «точное сходство»: мы называем стиль, показываем примеры и оставляем возможность перегенерировать сцену.
И держим у себя правило: цифру, которая нам не нравится, публикуем вместе с остальными. Замер, из которого выброшены неудобные строки, — это не замер, а реклама.
Проверить сходство на своём ребёнке можно бесплатно: превью собирается по фотографии до всякой оплаты.
Собрать превью по фотоСоседнее исследование: сравнение сервисов персональных книг — цены и возможности. Все наши данные — в разделе «Данные и исследования».