Disclaimer: все, написанное ниже, - исключительно мой опыт/ мои ощущения от работы с сетью, без анализа технических подробностей и характеристик.
Не знаю, как точно назвать себя и подобных людей, увлекающихся созданием CG картинок посредством нейросетей.
Возможно, это "CG художник", но скорее "CG-паразит" (если следовать логике профессиональных художников, обитающих в том числе на портале Artstation) :).
Итак, мне всегда нравились красивые обои на рабочем столе, но нарисовать что-то свое (даже карандашом) было и остается проблемой.
В конце осени прошлого года я узнал о существовании данной сети (когда прочитал заметку о подаче иска в суд против нее и Midjourney), решил попробовать свои силы в работе с ней и вот уже 5 месяцев получаю удовольствие от творческого процесса.
В работе со Stable Diffusion имею 2 больших ограничения:
а) работаю с сетью через браузер
б) не имею платной подписки и не использую платные модели
Из плюсов:
Пожалуй, главный (кроме тренировки английского, логики и фантазии) - это удовольствие от возможности творить.
То есть я, человек не имеющий никакого художественного образования, навыков, равно как и инструментов, могу при прямых руках, настойчивости, удаче и определенном чувстве стиля, создать что-то красивое, оригинальное или просто симпатичное за час-два или за минуту. Кроме траты времени нужно упомянуть о необходимости владения английским на приличном уровне
Работа именно с этой сетью по умолчанию бесплатна: вы можете генерить любое кол-во картинок в сутки (но не за один раз).
Но не все получилось сразу и очень многие вещи до сих пор скрыты от моего понимания/ моих возможностей.
Большая часть CG-художников специализируется на какой-то одной-двух темах (женские/ мужские портреты, монстры, герои комиксов, космос, машины и прочее-прочее). Я постепенно начал двигаться от одной тематики к другой: так интереснее.
В итоге примерный список тем моих картинок:
I Красная шапочка (почти 18+)
Большая часть CG художников в своих работах ссылаются на творчество Альфонса Мухи, Грэга Рутковски и Стэнли Артгерма Лау, чтобы получить колоритного и симпатичного героя/ героиню. Я сделал то же самое, но взял мотив сюжета из сказки о Красной шапочке и сером волке. В интерпретации сети они оказались не антагонистами, а компаньонами, что было необычно и гораздо интереснее. К тому же главной героине я добавил женственности.
II Вода и ее мифические обитатели (Ктулху и осьминоги).
С осьминогами все просто - для этого есть дуэт из арта студии Пиксар, того же Миядзаки и в моем случае Марка Райдена. Осьминоги в большинстве случаев получаются очень симпатичными.
Что касается Великого Древнего, то тут все было сложнее, хотя подробное описание его внешности и ссылка на Artstation и Лавкрафта, родили некий образ - одновременно жуткий и величественный.
III Пейзажи (вода, луна, камни, много Миядзаки, Зельды и немного арта Pixar).
Такие картинки сеть рисует легче всего и они самые симпатичные, хотя и достаточно примитивные.
Для меня тут главное найти что-то новое, какую-то новую фишку (например две луны, скалы, поросшие мхом, волны бирюзового цвета или чтобы они представляли собой зеркальную поверхность с отражениями).
IV Драгоценности.
Здесь все просто: через запятую перечисляем названия драгоценных камней, как они расположены, описываем свет и прочие подробности. На выходе получаем почти всегда то, что ожидаем.
V Рипли из "Чужого" (пожалуй, самый сложный в освоении персонаж).
Как я уже писал ранее, я не использую модели. Без них по умолчанию сеть будет генерить нечто с кривыми органами движения и просто некрасивым лицом.
Поэтому пришлось сделать несколько сотен итераций, прежде, чем получилось что-то более-менее похожее на ГГ хотя бы цветом волос, формой прически и линией рта (про то, чтобы загнать в картинку с Рипли чужого, речи быть не может).
"Прилепить" модели с картинки лицо Сигуирни Уивер начала 80-х я так не смог. Возможно, создатели сети поставили какой-то блок на генерацию картинок с некоторыми известными людьми. И про интерьер корабля "Ностромо" сеть тоже вроде как не слышала и отказывалась воспроизводить хоть что-то отдаленно похожее ((. Во вложении несколько примеров моих работ, связанных с образом Рипли/ фильмом.
Да, сеть использовала сотни и тысячи работ других художников, на которых я ссылаюсь в своих подсказках. Несмотря на это, чтобы получить по-настоящему качественную работу, иногда приходится тратить часы.
При создании Рипли главной целью была кинематографичность: чтобы, глядя на такую картинку, кто-то мог бы сказать "там такое было? Че-то не помню" )).
И в качестве резюме
Возможности, которые дает нам эта и другие похожие сети - это именно возможности, инструмент, которым можно пользоваться, а можно и нет.
Можно ездить на машине, а можно - на лошади или вообще пешком ходить. Все зависит от ваших потребностей, возможностей и амбиций. В конце-концов, это прогресс.
Он или возьмет вас с собой до следующей остановки, прокатит с комфортом или вы останетесь стоять, глядя ему вслед.
Что касается цифровых художников, дизайнеров и и в целом ребят, которые зарабатывают деньги своими работами, то, наверное, для большинства из них настали плохие времена.
Сети, если ничего не изменится в ближайшие полгода-год, задавят сначала количеством CG работ и потом уже их качеством..
Моя совесть чиста: я не конкурент настоящим художникам: творю в свое удовольствие и стараюсь каждую следующую работу сделать чуть сложней/ интересней предыдущей ))
Хотя, признаюсь, пробовал выходить на западные цифровые площадки. Но свезло: санкции на 90% сделали невозможной работу с ними/ получение денег.
В любом случае вы можете попробовать себя в роли такого художника-паразита, чтобы понять, насколько вам это интересно и сможете ли вы этим заниматься в принципе.
Он не совсем рисует). Он просто "собирает пазлы" из нарисованного другими (причем без спроса).
Это было актуально для первых версий неросетей для рисования, когда она тупо собирала пазл, сейчас все сложнее и от этого уходит.
Странно, я помню, что Вам уже писали, что он не собирает пазлы. Вы уже это узнали, а почему-то снова пишите. Какая-то странная реакция на информацию.
По сути версия с пазлом сейчас опровергается любым запросом наподобие: нарисуй Чужого в стиле Пикассо. И сеть это сгенерирует. Хотя Пикассо никогда не рисовал Чужих. Значит сеть понимает образы и стили. То есть умеет абстрактно понимать задачу, и примерять стиль, который изначально никогда не применялся для решения такой задачи
Действительно. Не рисовал.
А может это как раз и соответствует Чужому? У него так-то и люди не всегда на людей похожи :)
https://media.discordapp.net/attachments/104758289...
https://media.discordapp.net/attachments/104758289...
Попробуй интерфейс от automatic1111 со всякими дополнениями и расширениями. https://github.com/AUTOMATIC1111/stable-diffusion-...
Ему просто нравится так думать, он себя так успокаивает и отворачивается от любой информации не влезающей в его представления о мире.
"Alien" в английском языке подразумевается не обязательно ксеноморф из фильма, так что все правильно. Но ок, вот и ксеноморф в стиле Ван Гога. (введите в своей нейронке запрос: xenomorph, Van Gogh style)
https://media.discordapp.net/attachments/104758289...
Ну вот я и не понимаю, зачем? Отношение к информации должно быть как критерий правда/неправда, а не нравится/не нравится. Самообман не имеет никакого смысла и приносит только вред.
но, если владелец машины садится в нее, едет из точки А в точку Б и доволен результатом поездки, зачем ему задумываться о том, кто главнее - он или машина и как внутри нее все работает?...
они в равной степени важны друг для друга и в равной степени зависимы.
если бы я умел рисовать и рисовал бы классно, то таки да, я мог бы называться творцом с большой буквы "Тэ".
сеть дала мне в данном случае "костыли", чтобы начать передвигаться )
В большинстве картинок, которые сеть создала, у ГГ есть красный капюшон и красная куртка (это уже ее фантазия).
Не так просто получить от сети именно ту картинку, какую хочешь. Иногда на это уходит оч. много времени, и все равно может не получиться. Хотя скорее всего мне не хватает скилла.
Всё равно использует (причем физически, копирует файлы) чужие работы. Сами по себе нейронки ничего не могут. Вы можете взять кисть и что-то нарисовать наобум. Они- нет. Они пока не "скушают" мильён чужих работ - ничего не выдадут.
Это звучало бы убедительно, если бы Вы разрабатывали нейросети, или хотя бы были более менее крепким программистом. А так это всё ребяческая попытка показать свою "осведомленность", коей и в помине нет.
С другой стороны... Если человека попросить нарисовать то, чего он не знает, то и он не нарисует.)
Отчего ж? Человек может это представить и нарисовать по своему. У него есть фантазия. Увы, не у всех. Сейчас чаще лезут в гугл "искать рефы". Вот при таком подходе они от нейросетки мало чем отличаются).
Человек тоже перед тем, как что-то выдать должен долгие годы, что-то "скушать". Не с рождения ребенок вам там калякает картинки, тем более осмысленные. Это длительный процесс обучения, в том числе и на чужих примерах, работах и фотографиях и тд.
Нейронка тоже что-нибудь вам нарисует на любой запрос. Человеческая фантазия же тоже не из астрала образы воспроизводит.
На конечный результат (картинку) влияет куча вещей:
- подсказки (prompts), их порядок расположения/ их важность для сети;
- seed (код, который присваивается картинке при ее генерации);
- guidance scale (степень свободы фантазии сети при создании картинки);
- aspect ratio (соотношение сторон картинки);
- negative prompts (то, что в картинке видеть не хотите)
и прочее-прочее
также prompts и seed разных картинок можно комбинировать. иногда получаются неожиданные результаты.
вот здесь на простых примерах показана логика создания разных картинок
https://stablediffusion.fr/prompts
Все человеческие "представления" о том, чего человек не знает, будут основаны на том, что он знает. Человек не может нарисовать то, чего не существует в его голове. Точно так же и нейросеть рисует всё, что ей говорят, основываясь на своем обучении.
А откуда такая точная информации обо мне? У меня там где-то в профиле написано кто я и какие у меня есть знания? Вот ваше некомпетентность ясна из ваших комментариев.
Все всегда лезут за рефами, либо в интернет, либо в голову за воспоминаниями, либо глазками смотрят и используют это. Никогда по другому не было, всегда, все кто бы что не делал и использует базу опыта и образов, которым он обучился за жизнь, так же как это делает нейросеть. А любая фантазия, это просто умение работать с этой базой образов-референсов. Ничего уникально нового, того чего раньше еще не было человек придумать не в состоянии, всегда в основе лежит уже что-то созданное природой или содержащееся в окружающем мире. Нейросеть работает по принципу человеческого мозга, это так, вне зависимости от того, что вы думаете по этому поводу, разница лишь в совершенстве алгоритмов и их числе, а оно растет и развивается с каждым днем.
Вообще может. Абстракционисты рисовали то чего в их головах не было на момент начала работы. Некоторые просто выливают ведро краски. Кто может представить как оно растечется ? :)) Да и не абстракционисты - многие сравнивают процесс рисовния с медитацией - начинают и не знают что получится в итоге. Просто процесс и эксперимент.
Тааак, а теперь включаем серое вещество и думаем, а что же происходит в их головах в этот момент? Неосознанный перебор того что они видели (обучались как нейросеть всю свою жизнь) и теперь случайным образом берут куски этого и лепят в свою работу.
Все что мы делаем, это это было, если мы этого не понимаем как зритель, мы либо глупы, либо не образованы, либо это разбито на достаточно мелкие части и чтобы что-то понять, нужно изучать и анализировать глубже, разбирая на составные части изначальный образ. Но как правило первые два варианта.
Сложно не красивый арт создать, а предельно подходящий для требуемой задачи. Формально к SD прилагается много инструментов, но они компенсируются несовершенством самой нейросети, поэтому попариться конечно приходится много. И иногда действительно проще в 3d сделать.
Прикол нейронок я понимаю в том, что оно может нарисовать лучше, чем то что ты задумал:) Мы по старинке еще пытаемся заставить "точно по ТЗ", но прорыв произойдет когда придет понимание что "точного ТЗ" уже не нужно. Основное назначение картинок в современном мире - продать товар , через образ и эмоцию. До сих пор "точное тз" позволяло получить более менее предсказуемый по качеству образ. Теперь образ получается заведомо качественный без вот этих рамок и линеек. Но на "продажи" влияет не точность задуманного каким то одним автором или даже командой а уровень и сила эмоции на всю аудиторию.
согласен с вами, коллега - красивая и эмоциональная картинка лучше некрасивой.
это как лучше быть богатым и здоровым, чем бедным и больным )
если серьезно, то все люди разные (интеллект, воспитание, среда обитания и прочее) и как тут подстроится под всех, чтобы их "расчувствовать"?..
вчера наткнулся на картинку единорога из оригами на любимом ресурсе.
можно ли считать ее красивой/ эмоциональной?
как по мне, то исполнена она как минимум оригинально, поэтому она интересна.
пусть минимализм, пусть без роботов-захватчиков и прочих визуальных затей, но классно.
поэтому не всегда для достижения эффекта нужно использовать все спецэффекты сетей. бывает достаточно какой-то изюминки, концепции,
но для меня это уже магия, наверное. этому не научишься )
https://prompthero.com/prompt/021640cef4a
какой наивняк) учитывая то, что нвидия прямым текстом сказала, что следующее поколение графики будет не срендерено, а сгенерированно) зачем нужен 3Д если конечный результат это все равно 2д? 3Д проще и управляемее чем 2Д. Нейронки еще проще, но пока не так управляемы как 3Д. Так что 3Д первые на вылет. ЗАчем нужен весь эти ваши запекания, ретопы, сцены, риггинг и прочие мармосеты, если нейронке достаточно стикмена и простейшей анимации чтобы додумать сцену? Надо сказать я уже видел такие эксперименты на артстейшен. Да, пока у чувака появилось на промежуточном кадре второе колено и 3я пятка. Так что не обольщайтесь - все сидят в одной лодке. И она не то чтобы тонет, скорее те кто намочил ноги выгребает воду из пробоины, а другие радуются, что смотрите какой фонтанчик красивый.
Называйте себя "Суфлёром", во всяком случае так рекомендует называть людей вводящих запрос на генерацию в нейросети, Бюро Авторских прав в США, которое в марте этого года опубликовало документ объясняющий, что такие люди не могут считаться авторами и обладать авторскими правами на сгенерированный материал.
https://www.federalregister.gov/documents/2023/03/...
Приветы мамонту никогда не иссякнут !
Будет бум инфоцыган и вот этих вот называющие себя креативными и арт-директорами которые даже мысли свои сформулировать порой не могут.
Хороших ремесленников останется очень мало как и хороших фотографов и любых других мастеров.
Джуну пройти всю стадию до сеньора будет нереально в конкуренции с сгенерированным контентом просто потому что качество его работ будет такое же как и генеративный контент, а скорее даже хуже.
Все CG в скором времени будет создаваться посредством NerF технологии.
по форме, возможно, это название близко к истине, но по подержанию все сложнее.
по форме это некий человек, который сидит в растянутой майке-алкоголичке/ футболке перед монитором, пьет чай, ест бутер с колбасой, смотрит ролики на ютубе и раз в час лениво нажимает кнопку, которая пробуждает сеть и заставляет ее чего-то сгенерить.
на самом деле: чаще всего у тебя есть какой-то замысел.
сеть его пока не знает (ваш Кэп ;) и нужно ей рассказать о нем: описать сюжет, сделать ссылки на интересующих художников, рендеры и т.д,. и даже тогда сеть не сразу поймет, что от нее требуется.
может уйти и час и два и т.д., чтобы получить желаемую картинку.
картинка может в итоге получиться классной, но с изъяном: видно пол-лица или появился шестой палец или кривая нога/рука и т.д. и исправить это не получается никак. или получится, но с 10-ой итерации.
поэтому пока процесс работы с сетью не очень предсказуем.
и просто так накидать в нее кубиков-слов, а она там сама пусть разберется и из них что-то красивое слепит - это так пока не работает.
Те кто немного грамотнее, просто копируют промпты и изменяют их под себя, а особо одарённые, бегают из нейронки в нейронку, вводят в чат gpt или Bing запрос на создание промпта в разных локация, в разном времени года и времени суток с разным освещением и эмоциями. Получают штук 10 вариантов и обратно В полпути или в стабильную диффузию.
Конечно, любой процесс можно сделать творческим при желании, но для этого нужно приложить усилие.
А на деле, многим пользователям МЖ, очень трудно объяснить преимущество СД. Ведь там нужно немного думать, что-то учить, качать, устанавливать и разбираться в процессах.