Próbowanie sztuki AI
Po raz pierwszy naprawdę pomyślałem o sztuce generowanej przez sztuczną inteligencję, gdy Jason M. Allen zdobył nagrodę za swój obraz wygenerowany przez sztuczną inteligencję podczas targów stanowych w Kolorado . Dyskurs wokół tej wiadomości koncentrował się wokół tego, czy jego wizerunek można w ogóle zakwalifikować jako sztukę i jakie miejsce zajmuje wśród innych dzieł powstałych przy bardziej bezpośredniej interwencji człowieka. Jako zapalony fotograf , który znacznie lepiej czuje się z aparatem niż z ołówkiem, długopisem czy pędzlem, znam dyskusje na temat tego, jakie rodzaje mediów można nazwać „sztuką”. Rzeczywiście, Kevin Roose zauważa w swoim artykuleo zwycięstwie Allena: „Wielu malarzy wzdragało się przed wynalezieniem aparatu fotograficznego, który postrzegali jako poniżenie ludzkiego artyzmu… W XX wieku narzędzia do edycji cyfrowej i programy do projektowania wspomaganego komputerowo były podobnie odrzucane przez purystów za wymaganie zbyt małych umiejętności ich ludzcy współpracownicy”.
Ponieważ moje medium z wyboru było w przeszłości tak piętnowane przez purystów, których dyskurs o fotografii w XX wieku jest podobny do tego, który dotyczy dzisiejszej sztucznej inteligencji, czułem, że nie mogę odrzucić sztucznej inteligencji bez bycia hipokrytą. W końcu nie mam dobrej ręki do ręcznego rysowania. Tak więc, w interesie eksperymentu, chciałem lepiej zrozumieć, czy iw jaki sposób użycie Midjourney do tworzenia obrazów generowanych przez sztuczną inteligencję może wpłynąć na koncepcję sztuki i proces twórczy.
Dla mnie robienie zdjęć obejmuje mniej więcej:
- Przeżyj scenę, dokładnie przeanalizuj, co w niej przykuwa moją uwagę
- Patrząc przez wizjer mojego aparatu, wskazuj/poruszaj się w różnych kierunkach (lub przesuwaj mój obiekt, jeśli to możliwe/konieczne), dopóki nie znajdę dokładnego kadru/kąta, który przekaże powody, dla których uważam scenę za wyjątkową (jak określono w Krok 1)
- Wykonaj ujęcie: sprawdź/dostosuj elementy ekspozycji, zrób zdjęcie, sprawdź ponownie, na wszelki wypadek weź dodatki
- Edytuj: ulepszenia światła z ekspozycją, napraw problemy techniczne, jeśli to możliwe
Podczas gdy fotografia jest szybsza i wymaga mniejszej fizycznej manipulacji produktem końcowym niż w bardziej tradycyjnych formach sztuki, fotograf musi podejmować kluczowe decyzje dotyczące koncepcji i wykonania każdego zdjęcia, które wpływają na skuteczność przekazu. Jakie elementy uwzględnić w ramie? Pod jakim kątem strzelać? Kiedy naciskać migawkę i jak szybka powinna być migawka? Poza względami technicznymi, głównym czynnikiem ludzkim w fotografii jest estetyczne i emocjonalne poczucie, że coś jest warte uchwycenia w pierwszej kolejności. Na dobrym zdjęciu, podobnie jak we wszystkich mediach, fotograf z powodzeniem przekazuje widzowi to, co uważa za uderzające lub wzruszające w danej scenie. Walka, a czasem nie do końca realizacja wizji jest również częścią tego, co czyni sztukę ludzką.
Czy wykorzystanie sztucznej inteligencji do generowania obrazów odzwierciedla podobne doświadczenie w konkretyzowaniu wizji i przekazywaniu punktu widzenia? Czy proces zapewnia wystarczającą interwencję człowieka w kluczowych momentach tworzenia, aby człowiek, a nie maszyna, miał ostateczną kontrolę nad wiadomością? Mój pierwszy kontakt z obrazami generowanymi przez sztuczną inteligencję ujawnił serię czystych i dopracowanych obrazów, lepiej dostrojonych niż cokolwiek, co mogłaby stworzyć ludzka ręka. Tego można się było spodziewać. Ale dla mnie jeszcze bardziej imponujące niż techniczna czystość obrazów było to, że obrazy generowane przez sztuczną inteligencję były zaskakująco kompetentne w uchwyceniu ludzkich emocji. Natknąłem się na ten obraz dziewczyny, uderzający w swojej nudnej, zniszczonej depresji, który został wygenerowany z podpowiedzią: „12-latka w brudnych, znoszonych dziecięcych ciuchach, stoi w jasnym pokoju, trochę śmieci na podłodze, współczesny styl pokazowy, styl studyjny, styl kampanii balenciagi”. Biorąc pod uwagę, że bot przeszukałby sieć w poszukiwaniu obrazów ludzkich dziewcząt z ludzkimi emocjami, aby uzyskać wynik, można było natknąć się na zwycięską kombinację, która nadała dziewczynie odpowiedni wyraz twarzy, pasujący do zakurzonego i poobijanego nastroju otoczenia.
A jednak obraz nie wydaje się odpowiadać nastrojowi, który użytkownik chciał przekazać. Pokój nie jest szczególnie jasny, a obraz nie przypomina niczego, co mogłoby przypominać modny styl redakcyjny. A może wynik był dokładnie taki, jak zamierzał użytkownik, osiągnięty metodą brutalnych prób i błędów. W każdym razie brakuje kontekstu i ograniczonej kontroli człowieka nad danymi wyjściowymi komputera, więc widz nie może być pewien, czy obraz jest po prostu wynikiem szczęśliwego przypadku komputerowego (prawdopodobnie biorąc pod uwagę inne obrazy, które bot wypluwa za pomocą dokładnie ten sam monit) lub jeśli jest dokładnie tak, jak sobie wyobrażał użytkownik. Czy medium można naprawdę uznać za sztukę, jeśli nie daje widzowi pewności co do prawdziwych intencji twórcy?
Aby lepiej zrozumieć, w jaki sposób ktoś taki jak ja, który nie ma sprzętu ani wiedzy potrzebnej do tworzenia grafiki, mógłby wykorzystać Midjourney, spróbowałem wygenerować obraz plasterka tiramisu, który chciałem, aby wyglądał podobnie do tego . Podpowiedź, której użyłem, brzmiała „ kawałek tiramisu przyozdobiony ziarnem kawy na białym talerzu, rysunek”, co dało następujący wybór czterech obrazów:
Styl był bardzo zbliżony do tego, co sobie wyobrażałem, ale bot miał trudności z kształtem widelca, krawędziami ciasta i umieszczeniem ziaren kawy (chciałem, żeby tylko jedno ziarno kawy leżało na bitej krem do dekoracji). Nie byłem pewien, jak bot interpretuje przecinki, więc być może bot nie wiedział, czy dekoracja była przeznaczona na ciasto, czy na talerz. Po kilku wariacjach najbliższy i najczystszy wynik, jaki mogłem uzyskać, był następujący:
Wolałbym raczej prostokątny niż trójkątny plasterek, a na talerzu wciąż było za dużo „fasoli” jak na mój gust. Gdybym współpracował z grafikiem, byłyby to łatwe do przekazania funkcje i nie byłoby żadnych problemów z brzegami tortu. Błędy sprawiały, że obrazy generowane komputerowo wydawały się jeszcze wyraźniejsze, ponieważ były to błędy, których człowiek nigdy by nie popełnił.
Czy ten proces przypominał tworzenie sztuki? Miałem wizję i chciałem użyć narzędzia do jej realizacji, ale nie mogę powiedzieć, że wygenerowanie tych obrazów wymagało jakiejkolwiek kreatywności z mojej strony. Nadal czułem się, jakbym zamówił dzieło sztuki, ale raczej z komputera niż z człowieka. Oprócz problemów z wykonaniem komputera, było coś zimnego i nietykalnego w generowanych przez sztuczną inteligencję plasterkach tiramisu. W żadnym momencie nie miałem okazji przekazać mojej osobistej wizji uczuć, jakie powinno wywoływać tiramisu. W końcu ani „słodki”, ani „pyszny” nie da się sprowadzić do algorytmu.
O sztucznej inteligencji mogę jednak powiedzieć, że była w stanie przekształcić abstrakcyjne idee w konkretne obrazy, co w wielu kontekstach byłoby więcej niż wystarczające. Istnieje wiele pięknych obrazów generowanych przez Midjourney, które dobrze nadawałyby się do takich rzeczy, jak plakaty lub okładki książek. Gdy technologia stanie się mądrzejsza, będzie popełniać mniej błędów, które tak odrażały mnie w przypadku mojego tiramisu. Ale jeśli mam czas i budżet, nie widzę siebie wybierającego obraz wygenerowany przez sztuczną inteligencję zamiast podobnego wykonanego przez ludzkiego artystę. W końcu sztuka jest dziełem ludzi dla ludzi i żadna technologia tego nie zmieni.

![Czym w ogóle jest lista połączona? [Część 1]](https://post.nghiatu.com/assets/images/m/max/724/1*Xokk6XOjWyIGCBujkJsCzQ.jpeg)



































