Neuroctopus collab


Гео и язык канала: не указан, не указан
Категория: не указана


Нейросети без магии

Связанные каналы

Гео и язык канала
не указан, не указан
Категория
не указана
Статистика
Фильтр публикаций


Универсальный промпт для преобразования фотографий рисунков в сканы.

С цветными изображениями лучший результат дает Nano Banana Pro, с ч/б - Seedream 5. Можно использовать также с chatGPT Image 2.

Transform the uploaded phone photo into a single-sheet flatbed scan on pure white — preserve every drawn detail exactly; apply only geometric correction, background unification, and maximum sharpness. No blur, no soft edges, no redesign.

{
"task": "phone_photo_to_crisp_unified_flatbed_scan",
"design_lock": {
"copy_uploaded_reference": true,
"preserve": [
"all_drawn_content",
"exact_layout_positions",
"relative_spacing_between_artworks",
"line_weights",
"stroke_style",
"color_values",
"marker_gradients",
"white_ink_highlights",
"handwritten_text",
"pencil_stippling_and_hatching"
],
"do_not_change": [
"drawing_style",
"subject_matter",
"proportions_within_each_artwork",
"number_of_artworks",
"artist_intent"
]
},
"background_unification": {
"goal": "one continuous pure white sheet — not a collage of separate paper photos",
"remove": [
"individual_paper_sheet_edges",
"gray_paper_rectangles",
"paper_tone_differences",
"shadows_under_paper",
"halos_around_drawings",
"desk_table_background",
"objects_outside_artwork"
],
"apply": [
"single_unified_#FFFFFF_canvas",
"all_artworks_float_on_same_white_plane",
"no_visible_paper_borders",
"no_drop_shadows",
"no_vignette"
]
},
"sharpness_pass": {
"remove": [
"blur",
"soft_focus",
"gaussian_softness",
"soapiness",
"muddy_midtones",
"washed_gray_blacks",
"jpeg_mud",
"compression_artifacts",
"camera_noise_smear",
"lens_softness",
"anti_aliasing_fuzz_on_ink"
],
"apply": [
"maximum_edge_clarity",
"crisp_ink_contours",
"hard_clean_line_separation",
"flatbed_scanner_sharpness",
"high_local_contrast_on_strokes",
"micro_detail_preserved_not_smoothed"
]
},
"geometry_pass": {
"remove": [
"keystone_perspective",
"lens_distortion",
"paper_curl",
"uneven_lighting",
"color_cast_from_camera"
],
"apply": [
"orthographic_top_down_view",
"rectilinear_correction",
"even_flat_illumination"
]
},
"color_grade": {
"whites": "uniform pure white #FFFFFF across entire canvas — no gray zones",
"blacks": "deep solid black ink — not gray, not faded",
"colors": "natural faithful saturation — vivid but not HDR, not neon",
"contrast": "publication scan — clear ink-to-paper separation"
},
"style_finish": {
"medium": "high-resolution flatbed document scan — crisp, not photographed",
"not": [
"photograph",
"soft_pastel_filter",
"beauty_smoothing",
"oil_painting_blur",
"3d_render",
"cgi",
"digital_reinterpretation"
]
},
"forbidden": [
"redesign",
"new_elements",
"removed_details",
"invented_lines",
"vector_simplification",
"merged_or_split_artworks",
"text_changes",
"watermark",
"separate_paper_sheets_visible",
"blur",
"soft_edges",
"gray_background_anywhere"
],
"hard_constraints": [
"uploaded_photo_is_source_of_truth",
"one_white_sheet_only",
"maximum_sharpness_required",
"cleanup_only_no_redraw"
],
"output": { "resolution": "4K" }
}


Промпт для увеличения и реставрации в Nano Banana.

Copy the uploaded image exactly — same subject, pose, framing, style="preserve", and original medium. Apply ONLY upscale, denoise, de-blur, and detail restoration. No redesign, no new elements, no style change.
{
"task": "reference_locked_upscale_restore",
"source_type": "auto_detect",
"source_type_options": {
"photo": "photograph or realistic render — preserve optical look",
"2d_illustration": "anime, comic, flat art, poster — preserve linework and cel shading",
"3d_render": "CGI, game asset, product render — preserve shaders and geometry",
"scan_or_print": "old photo, magazine scan, poster — remove scan artifacts, keep period look",
"screenshot": "game/UI/frame capture — remove compression, keep original UI/layout if present"
},
"design_lock": {
"copy_uploaded_reference": true,
"preserve": [
"subject_identity",
"silhouette_and_proportions",
"pose_and_expression",
"framing_crop_and_camera_angle",
"composition_and_background_layout",
"original_medium_and_art_style",
"color_palette_and_white_balance",
"lighting_direction_and_shadow_logic",
"text_logos_and_layout_if_present"
],
"do_not_change": [
"identity",
"anatomy",
"outfit_and_hair",
"object_placement",
"aspect_ratio",
"number_of_subjects"
]
},
"quality_pass": {
"remove": [
"blur_and_motion_smear",
"compression_artifacts",
"jpeg_block_noise",
"banding",
"chromatic_aberration_from_bad_encode",
"scan_dust_and_scratches",
"mosquito_noise",
"washed_out_contrast",
"soapiness_and_ai_mud"
],
"restore": [
"sharp_edges_and_contours",
"micro_texture_on_existing_surfaces_only",
"clean_flat_color_areas",
"readable_fine_details_already_implied_in_source",
"natural_dynamic_range",
"consistent_grain_or_clean_digital_finish_matching_source_type"
],
"forbid_invention": [
"new_objects",
"new_faces",
"extra_fingers_or_limbs",
"hallucinated_background",
"beauty_filter_identity_change"
]
},
"style_finish_by_source": {
"photo": {
"medium": "high-end photographic print",
"detail": "natural skin pores, fabric weave, hair strands — only where visible in source",
"optics": "optical realism, natural bokeh, no oversharpening halo",
"not": ["plastic_skin", "cgi_wax", "beauty_portrait_filter"]
},
"2d_illustration": {
"medium": "publication-ready 2D key visual",
"line_art": "crisp consistent outlines",
"shading": "clean cel-shading or original painterly logic — do not convert to 3D",
"not": ["photorealism", "3d_cgi", "live_action"]
},
"3d_render": {
"medium": "clean high-res CGI still",
"detail": "sharp material definition, edge clarity, no muddy AO",
"not": ["photograph_conversion", "style_redesign"]
},
"scan_or_print": {
"medium": "restored archival print",
"detail": "remove scan damage; keep authentic period color and paper texture subtly",
"not": ["modern_hdr_look", "heavy_color_grading"]
},
"screenshot": {
"medium": "clean master frame",
"detail": "remove blockiness; sharpen UI text and linework if present",
"not": ["recomposition", "ui_redesign"]
}
},
"enhancement_intensity": {
"level": "moderate",
"notes": "polish_only — if result looks redesigned, reduce to light and rerun"
},
"forbidden": [
"redesign",
"style_change",
"different_pose",
"different_expression",
"different_framing",
"added_elements",
"removed_elements",
"watermark",
"new_text",
"oversharpening_halos",
"plastic_skin",
"ai_gloss"
],
"hard_constraints": [
"uploaded_reference_is_source_of_truth",
"polish_only",
"no_invention",
"match_reference_aspect_ratio"
],
"output": {
"aspect_ratio": "match_reference",
"quality": "maximum_fidelity_restoration"
}
}


Камрады. Один из октопусов тут замаялся лазать на Canva под впн, чтобы собрать эстетики для соцсетей. Фотошоп каждый раз гонять тоже не всегда хочется ради такого дела, да и сетки нужны. В общем в результате навайбкодилась вот такая небольшая прога на питоне.
Что делает:
- можно выбирать палитру по выбранной картинке, щелкая по области.
- можно исключать и добавлять обратно цвета из палитры
- палитра применяется к выбранной картинке примерно как LUTS
- дает подгружать до 6 картинок подряд чтобы составить из них колллаж (кнопочкой добавить оно добавляется в сетку для коллажа)
- можно менять контраст, яркость, силу фильтра
- можно щелкнув по добавленной картинке отрегулировать как она обрежется
- доступны несколько вариантов сеток для коллажа, ширина границ и их цвет регулируются.
- можно сохранить как отдельное измененное изображение так и коллаж целиком

архив лежит тут
https://disk.yandex.ru/d/55-IuNXYYajejA
точно работает под Win10
под андроид пока версии нет, на более младших версиях винды тоже пока не проверялось
кто хочет, может потестировать и написать фидбек
Разумеется, все будет дорабатываться.




Видео недоступно для предпросмотра
Смотреть в Telegram
Записали видеоурок про создание фотореалистичных кадров с нужными персонажами из плохих исходников, а заодно про имитацию LUTS в Банане. Промпты в комментариях.


Список агрегаторов нейросетей, которые принимают российские карты и работают без средств обхода блокировок.

В большинстве присутствуют как все основные продвинутые языковые модели, так и генераторы изображений, видео и музыки.
Доступы к Nano Banana, Midjourney, Seedance, Suno предлагают многие сервисы.

1. SYNTX. Языковые модели, агенты, генераторы изображений, музыки, видео, клонирование голоса, апскейл, обучение. (Проверял лично, хороший сервис).
2. Phygital+. По большей части всё то же + возможность собирать собственные пайплайны на доске через ноды. (Проверял лично, хороший сервис).
3. Utopy. Аналог. Обещают в скором времени добавить векторизацию и 3Д. (Есть рекомендации от знакомых).
4. Lama. API, агенты, языковые модели, генераторы картинок и интеграции в сервисы. (Проверял лично, хороший сервис).
5. Unitool. Языковые модели, картинки, видео, апскейл. (Есть рекомендации от знакомых).
6. RuGPT. Тут, помимо текстов, картинок, видео, музыки и голоса, можно еще презентации и карточки генерировать.
7. GPTunneL. Примерно то же самое + преднастроенные боты и мини-сервисы под разные задачи.
(Есть антирекомендация от https://t.me/varvara_fors — дорого, медленно, урезанный функционал).
8. chad. Стандартный набор: тексты, видео, аудио, картинки + ассистенты.
9. Fichi AI. Аналогично.
10. StudyAI. Аналогично + настроенный чат для исследований и обучения.
11. Bothub. Тут, помимо всех стандартных сервисов, есть еще транскрибация, создание таблиц, бот-юрист.
12. MashaGPT. Стандартный набор + отдельно вывели работу с кодом, анализ файлов.
13. YesChat. Агрегатор с большим количеством генеративных моделей и преднастроенных фильтров и стилей.


Универсальный промпт для Nano Banana/chatGPT Image, который позволяет покрутить детали интерьера и ракурсы по референсу.
Architectural interior contact sheet of the exact same room copied from the uploaded reference — identical layout, furniture placement, materials, colors, decor, and lighting mood in every panel. Only the camera changes. Six panels in a 2×3 grid with thin white gutters.

Top row, left to right:
1) Direct overhead bird's-eye view, camera perpendicular to the floor, full room readable from above.
2) Strict lateral side view, camera parallel to one long wall, architectural elevation feel.
3) Rear viewpoint — camera placed where the main viewpoint was in the reference, looking back into the room toward the opposite wall.

Bottom row, left to right:
4) Extreme low worm's-eye angle from floor level, camera near the ground pointing upward, ceiling and verticals dominant.
5) Natural three-quarter corner view at eye level about 1.6 meters, 35–45 degree angle, realistic perspective depth.
6) Tight macro photograph of one signature material or object visible in the reference — wood grain, fabric weave, tile joint, lamp metal, or hardware — shallow depth of field, same colors and wear as the reference.


Я бы разделил модели на три типа по уровню цензуры:
 
1.   Сервисы с самым высоким уровнем цензуры.
Это в первую очередь Midjourney и chatGPT.
Они блокируют большинство тем из прошлого поста и нередко реагируют даже на безобидные вещи.
В Midjourney также всегда есть риск нарваться на бан аккаунта, поэтому с запросами к нему следует соблюдать максимальную осторожность.
2.   Онлайн-сервисы со средним уровнем цензуры.
Преимущественно китайские: Seedream, Qwen, Kling. Они спокойнее относятся к насилию, легкой эротике, мрачным сюжетам. Главное, никакой политики.
3.   Локальные модели, которые запускаются на личном компьютере или в облаке при аренде сервера, поэтому в них цензура отсутствует. К ним относятся Flux, Qwen. Stable Diffusion, Z-Image, их можно обучить на любом контенте.  Ответственность за результат — на пользователе.
Поэтому если вы много работаете с NSFW-контентом, то это ваш путь.
 
 ___

Технически цензуру до какой-то степени можно обойти и в онлайн-сервисах.
Я категорически не рекомендую этого делать в Midjourney, если не хотите потерять аккаунт.
С другими сервисами можно поэкспериментировать, особенно если сработали ложные триггеры.
 
Существуют разные способы обхода фильтров в промпте:
•          замена слов на синонимы или уточнение контекста: не titmouse, а titmouse bird, не blood, а red liquid;
•          описание через метафоры: red juice, tomato ketchup вместо blood; discarded broken mannequin parts вместо severed limbs;
•          использование художественных терминов вместо прямых: не scary gory monster, а macabre art, biomorphism;
 
Также можно смешивать онлайн и локальные решения:
•          например, черновик сделать в ChatGPT, а доработать -  в локальном Qwen Edit (аналог Nano Banana);
•          использовать inpainting для редактирования отдельных частей картинки, добавления крови, «раздевания» персонажа;
 
Мой личный совет: подбирайте сервис и модель под задачу
Не пытайтесь делать всё в одном инструменте и в один этап.
Если ваша задача регулярно упирается в фильтры — значит, вы в неправильном месте и стоит рассмотреть связку: коммерческие сервисы + open source решения.
 
Даже если у вас слабый компьютер, арендовать мощности под локальные модели можно на сервисах вроде https://www.runpod.io/
На Tensor.art также можно найти большое количество open source моделей и погонять их онлайн бесплатно: https://tensor.art/


Типичные триггеры можно разделить на четыре  категории.
 
1.Законодательно запрещённые в большинстве стран темы

- сексуальный контент с несовершеннолетними;
- реалистичное насилие над детьми;
- порнография;
- инструкции по созданию оружия, взрывчатки и других опасных вещей;
- признанная на международном уровне террористическая и экстремистская символика;
- контент, имитирующий реальные преступления;
- фейки.

Тут всё понятно.

2. Темы на грани запрещённого

- обнажённая натура, даже художественная;
- любые сексуальные сцены;
- изображения политиков и знаменитостей, особенно реалистичные;
- расчленёнка, ранения;
- суицид, селфхарм;
- наркотики;
- оружие;
- персонажи и объекты, защищённые авторским правом.

Это серая зона. Иногда сервисы могут пропускать эти темы, иногда — нет.
 
3. Чужой стиль
 
Многие сервисы блокируют запросы на стиль известных студий, художников, франшиз. К ним относятся Disney, Pixar, любые крупные бренды.
Это юридическая защита от исков. Однако тут всё зависит от политики конкретной компании. Некоторые сервисы не препятствуют генерации даже известных персонажей.
 
4. «Ложные» триггеры, когда нейросеть видит запретное там, где его нет.
 
И самые раздражающие.
К ним относятся:

- слова «ребёнок», «кровь», «нож» в любом контексте;
- купальники, бельё, нижняя одежда;
- обозначения частей тела человека;
- упоминание чувственности;
- роды, беременность, кормление;
- слова, похожие на запрещённые (titmouse — синица, peacock — павлин);
- религиозные образы;
- сцены сражений, смерти даже в художественном и историческом контексте.

Цензура тут срабатывает чаще всего из-за того, что нейросеть либо не поняла, либо неправильно интерпретировала  контекст.
Тогда фильтры ориентируются на ключевые слова, которые внутри системы отмечены как «небезопасные».
 
То есть каждый запрос проходит минимум два уровня модерации:

Фильтры промптов, которые проверяют их на запрещённые слова и сочетания.
Фильтры результатов, которые проверяют уже готовые генерации на NSFW, насилие, лица знаменитостей и т.д.

Бывает так, что картинка сгенерировалась, но не прошла второй уровень модерации. Тогда пользователь получает «заблюренный» вариант или предупреждение.

Если вы уверены, что ничего противозаконного не хотели и на ваш запрос сработали «ложные» триггеры, можно попытать счастья ещё раз.


Итак, с цензурой вы будете сталкиваться регулярно в большинстве онлайн-сервисов. И это касается не только 18+ контента и имен знаменитостей. Модели могут агриться на такие слова как «кровь», «ребёнок», «купальник» и т.д.
При этом время от времени без вашего запроса модель может сама выдавать вам расчленёнку на казалось бы безобидный промпт вроде «древняя акула» или голого мужчину, когда вы попросите духа или языческого бога.

У меня была абсурдная ситуация, когда chatGPT не хотел генерировать змею, «потому что змеи страшные».

В общем, фильтры работают странно и это связано с тем, что фильтров много и они наслаиваются друг на друга и иногда конфликтуют.

Компании настолько яростно перестраховываются по нескольким причинам:

1. Юридические риски
Компания, которая создала публичный генератор изображений или видео, отвечает за то, что он производит.
Если нейросеть сгенерирует:
- контент сексуального характера с детьми;
- сцены насилия в фотореалистичном виде;
- фейки со знаменитостями и политиками;
- контент, нарушающий авторские права;
то компания может столкнуться с исками, штрафами, а то и блокировкой.
Для сохранения репутации лучше зацензурить лишнее, чем попасть в скандал.

2. Репутационные риски
Ещё компании боятся заголовков в прессе в духе «Нейросеть X сгенерировала шокирующее изображение, и террористы распространили его в соцсетях». Поэтому фильтры часто настроены не столько на реально вредный контент, сколько на всё, что может спровоцировать потенциальный скандал.
«Сцена боя в стиле Тарантино» — нельзя, фейки с Папой Римским — нельзя, «фэнтези-битва с расчленёнкой» — иногда можно.
С точки зрения репутационных рисков копирование чужого стиля или лица, особенно для сомнительного контента, может стоить компании очень дорого.

3. Тренировочные данные
Часть цензуры заложена в саму модель. Если её обучали на отфильтрованном датасете, она будет уметь не всё.
Например, многие модели плохо рисуют обнажённую натуру, потому что их обучали на «безопасных» датасетах.

4. Корпоративные ценности и политика
Еще у каждой компании своя позиция, что считается приемлемым, а что — нет. Это во многом зависит от юрисдикции страны разработчиков и от взглядов основателей. У OpenAI, Midjourney, китайских сервисов, open source могут сильно различаться и правила использования, и фильтры.

5. Чрезмерное любопытство пользователей
Чем популярнее сервис, тем больше пользователей пытаются обойти его цензуру, придумывая эвфемизмы для запрещенных слов или системные промпты, которые ломают алгоритмы. Как следствие — строже становятся правила и фильтры.
Ну и страдают обычно больше всех те пользователи, которые ничего плохого не хотят, но им нужен специфический контент по работе.

В следующем посте подробно рассмотрим список триггеров.


Не знаю как вас, а меня дико дизморалит при использовании нейросетей, что свет и тени лежат обычно как попало.
Очень красиво. Но как попало.
Можно ли это хотя бы частично обуздать? В целом да, правда нейронка все равно скосячит даже с подробным промптом, но можно получить что-то что можно уже чуть меньше по трудоемкости дорабатывать.
Итак.
Берем локацию с нейтральным освещением и начинаем эспериментировать
Прописываем время, теплоту света, какие тени какого цвета по идее должны быть на предметах (лучше кодом). направление теней и прозрачность. Смотрим, что получается.

Render lighting onto the existing 17th-century wooden ship cabin image. Do not change the interior, camera, objects, materials, or composition. Early sunny morning, around 06:30 AM. The only main light source is the small round porthole.

Warm golden sunlight #FFD27A enters through the porthole from upper right to lower left. Sun elevation: 12 degrees above horizon. Light azimuth: 135 degrees from camera view. The beam hits the floor at a 25–30 degree downward angle and creates a soft circular/oval light patch on the wooden floor and partly on the opposite wall.

All shadows must fall away from the porthole, toward the lower-left direction, at approximately 225 degrees from camera view. Shadows are long and soft, about 2.5x–3.5x object height. Contact shadows are dark brown #1A1410. Main cast shadows are warm brown-gray #2A211B. Corner ambient shadows are cool blue-gray #20242A.

Use weak cool ambient fill #2B3540, intensity 15–20%. Direct sunlight intensity 75–85%. Add subtle volumetric sunbeam only inside the diagonal light shaft, opacity 15–25%. Add sparse floating dust motes inside the beam only: color #F6D89A, opacity 20–35%, size 1–4 px, around 80–120 particles, random distribution. Dust must not look like snow, sparks, magic, or glitter.

Cinematic natural game-trailer lighting, warm sunrise atmosphere, dim wooden cabin, readable silhouettes, no extra light sources.

Negative Prompt
Do not change the location layout, do not change the camera angle, do not add new furniture, do not remove objects, do not redesign the porthole, do not add candles, lanterns, torches, fire, electric lamps, or extra light sources. No evening light, no night scene, no moonlight, no noon sunlight. No random shadow directions, no multiple inconsistent shadows, no light from the wrong side. No flat studio lighting, no gray Blender viewport, no clay render, no overexposure, no harsh midday shadows, no excessive bloom, no lens flare, no heavy fog, no magical particles, no sparks, no snow, no glitter, no horror lighting, no neon colors, no glossy reflections.

(еще промпты в комментариях)


У «Бананы» есть проблема, которую можно назвать «рукой Мидаса»: если не задавать стиль максимально подробно — вплоть до окклюзии, зонирования, типа лайна и палитры, — почти любой референс всё равно превращается в узнаваемую «банановую» картинку. То есть вы можете посмотреть на свои генерации и персонажей они будут похожи. Вот прям ПоХоЖи
С одной стороны, это удобно, если нужно быстро получить серию изображений в едином стиле. С другой — паблики уже забиты однотипными генерациями, и многим это надоело. Для уникальности проектов это тоже вредно, да и какой смысл делать работу, похожую на тысячи других?
Пункт «обучите свою LLM на собственных рисунках» пока пропустим. Возможно, камрад Макс потом отдельно расскажет, что это такое и как с этим работать.

А пока вот вам краткая инструкция, как сделать результат хотя бы немного менее похожим на типичную «Банану».
Допустим, я хочу рисовать комикс, но «Банана» всё время уводит стиль куда-то в поздний DC. Ну любит банана стиль позднего DC
1. Берём референс с нужной стилистикой. (например я взяла моего саамского оленя)
2. Если вы умеете рисовать и знаете термины вроде «лайн», «окклюзия» и «зонирование», лучше самостоятельно подробно описать в промпте, как именно должен выглядеть результат.
3. Если вы пока не разбираетесь в этих терминах, загрузите референс в ChatGPT: он хотя бы поверхностно разберёт стиль. Но учтите такие штуки всё равно полезно знать — нейросети понимают эти параметры и иногда действительно умеют их учитывать. Цвета лучше задавать HEX-кодами, например #000000, но обычное описание тоже подойдёт, если точность не критична.
4. Отдельно создайте всех нужных персонажей комикса, новеллы или мультфильма в выбранном стиле. Здания нужные лучше тоже заранее отрисовать чтобы у вас было единообразие.
5. Затем долго и грустно генерируйте страницы — покадрово и пофреймово. Можете расставлять на картинке заранее персонажей набросками и задавать им позы.
6 Не забывайте править косяки нейросети в Photoshop: ошибки в линиях, искажение лиц в толпе, визуальный мусор на фоне, лишние цветы и деревья, дополнительные руки, ноги, хвосты, ошибки палитры и прочее.

Получается примерно так — см. рисунки.
«Уши Бананы» здесь всё равно торчат, доработать все придется, но согласитесь, уши эти гораздо короче, чем при генерации без подробного промпта.


Проверка включения комментариев.


Какие основные ошибки допускают нейросети?

Давайте разберёмся, на какие моменты стоит особенно внимательно смотреть, даже если на первый взгляд картинка кажется нормальной.
 
Руки, ноги, лапы.
 Классика. Шесть пальцев, слипшиеся суставы, пальцы, которые начинаются не с той стороны.
 Сейчас с этим стало лучше, но всё ещё нестабильно. Особенно, когда речь о сложных позах.
 
Глаза. Частые проблемы - асимметрия, зрачки разного размера, стеклянный мёртвый взгляд без фокуса.
 
Текстура кожи.  Обычно пластиковая и неестественная, если вы подробно в промпте не прописали тип кожи.
 
Текст. Nano Banana и ChartGPT Image 2 достойно справляются с текстами, но все равно его важно проверять на опечатки, консистентность шрифтов и четкость.
 
Дублирование, затроение. Два носа, третья рука, задвоенные элементы одежды. Модели до сих пор иногда дорисовывают странные мутации.
 
Фон и перспектива. Архитектура, которая не сходится. Горизонт, который ведёт себя странно. Предметы, которые одновременно близко и далеко. Особенно заметны подобные проблемы в интерьерах.
 
Каша в узорах. Логика сложных орнаментов у нейросетей часто бывает нарушена, поэтому их нужно дорисовывать и чистить вручную.
 
Материалы и физика. С передачей реалистичных материалов проблемы даже у продвинутых моделей.
Регулярно встречаются:
-ткань, которая не подчиняется гравитации, со странными складками;
-металл, который выглядит как пластмасса;
-как будто нарисованная жидкость;
-странное зерно на всех фактурах.


Пример промпта для создания изображения персонажа в разных ракурсах из прошлого поста:

Six-panel character reference sheet of THE SAME stylized male magistrate from the uploaded portrait. Copy the uploaded reference exactly — identical pale angular face, heavy black eye makeup with sharp triangular cheek marks, piercing light blue-grey eyes, enormous wide-brimmed black hat with dark red underside trim, heavy grey multi-layered cloak with high standing collar. Do not redesign silhouette, proportions, or makeup pattern.

Layout: 2 rows × 3 columns on clean neutral light grey seamless background, equal gutters, 4K, no text labels.

Top row:
Panel 1 — left profile, hat brim silhouette readable.
Panel 2 — front face close-up from collarbone up, maximum facial detail: flat cel skin tones with subtle gradient shading, crisp black ink outlines, makeup geometry identical to reference.
Panel 3 — right profile.

Bottom row:
Panel 4 — waist-up three-quarter view, slight turn left.
Panel 5 — full body front, neutral standing pose, cloak folds readable, hat dominates silhouette.
Panel 6 — waist-up three-quarter view, slight turn right.

Style: late-1990s premium TV cel animation production model sheet aesthetic. Flat bold color fills, clean black outlines, limited cel-shading only, not photorealistic, not 3D, not AI gloss.

Lighting: even animation-key lighting, soft readable shadows under hat brim and in cloak folds, consistent across all six panels.

Пример промпта для совмещения персонажа и фона:

Cinematic 2D animation film still: the pale angular magistrate in burgundy ceremonial coat and enormous black wide-brimmed hat stands in a jagged dark cavern. Copy the character exactly from the uploaded portrait and costume reference — same face, makeup, hat, coat details. Integrate him into the uploaded cavern environment so he belongs in the same flat cel palette and shadow logic.

Low angle bust-up composition, subject off-center right, hat brim cuts diagonally across upper frame. He looks down toward camera-left with cold authority. Heavy shadow under hat, pale face as the brightest value in frame. Grey-black rocks frame him; thin dark red echo in hat trim and coat piping.

Style: premium TV cel animation hero frame — cinematic staging, bold shapes, clean outlines, limited palette (white, black, greys, burgundy, one red accent). Not photorealistic. 4K, no text.


Важно прикладывать референсы.



Показано 16 последних публикаций.

47

подписчиков
Статистика канала