Memová kultura ožívá. Sociální sítě zaplavila videa generovaná umělou inteligencí

Vylepšená verze programu Sora2 umožňuje generovat realistická videa. První se nové technologie ujali tvůrci internetových vtípků.

Karel Veselý
Obrázek Easy-Peasy.AI. CC BY-ND 4.0

Michael Jackson krade v řetězci rychlého občerstvení a za doprovodu svého typického hýkání utíká ochrance. Bigfoot natáčí s pomocí selfie tyče reportáž z hudebního festivalu a zkonzumuje u toho nelidské množství drog. Morbidně obézní lidé se účastní soutěže v akrobatických skocích do vody z prkna a s každým skokem vyplaví bazén… To jsou jen některé příklady realisticky vypadajících videí generovaných s pomocí programu Sora2. Poslední měsíce vzaly útokem sociální sítě a odhalují nové nevídané možnosti tvorby internetového obsahu. Probudily skomírající memovou kulturu, ale také otevírají otázky ohledně etičnosti využívání mrtvých celebrit nebo nebezpečí jejich zneužití pro tzv. deepfakes. Zatím je to ale hlavně velká sranda.

Společnost OpenAI, kterou před deseti lety založili Elon Musk a Sam Altman, vydala novou verzi svého „text-to-video“ softwaru na konci září a zatím je dostupná jen v USA a Kanadě, a to na pozvánku. Videa z ní se ale už šíří po celém světě a překvapují svou realističností. Zatímco první verze vydaná vloni ještě obsahovala občasné vizuální chyby, podle nichž šlo poznat, že jde o produkt generativních programů, u vylepšené novinky už budete mít nejspíš problém rozlišit realitu a AI. Obrázkový „podpis“ aplikace Sora2, který musí generovaná videa povinně obsahovat, se navíc po pár dnech hackerům podařilo vymazat, takže si videa už mohou žít vlastním životem.

Oblíbeným metavtípkem jsou teď videa podcasterů, kteří se dívají na videa a hádají, jestli jsou skutečná, nebo je to produkt umělé inteligence.

Společnost OpenAI se nijak netají tím, že své modely učí hlavně požíráním obsahu internetu. Nemá proto problém uživateli vygenerovat cokoli, co mu vyvstane na mysli. Jisté limity ale samozřejmě pořád existují. Týkají se používání fotografií skutečných žijících lidí (můžete použít jen svoji) a také pornografického nebo násilného obsahu. Tyto bariéry ale dost možná brzy také padnou. Na konci září Sam Altman na X oznámil, že ChatGPT ještě letos povolí generování „erotického obsahu pro verifikované dospělé“, a dá se očekávat, že součástí toho posunu, popsaného jako „chovejme se k dospělým jako k dospělým“, budou i modely generující videa.

Realističnost videí vytvořených s pomocí Sory už teď znepokojuje pornografický i filmový průmysl, nicméně prvními poškozenými jsou mrtvé celebrity, jejichž podobu můžete v programu použít. Tedy alespoň do chvíle, než se ozvou jejich pozůstalí a požádají o vymazání z databáze. „Už mi prosím neposílejte další AI videa s mým tátou,“ napsala na instagramu v polovině října Zelda, dcera herce Robina Williamse. „Jestli máte aspoň trochu slušnosti, přestaňte to dělat jemu i mě. Tečka. Je to hloupé, plýtváte časem a energií a věřte mi, že on by tohle rozhodně nechtěl.“ Podobná byla i reakce potomků Michaela Jacksona – Sora oznámila, že další videa se zpěvákem už nevzniknou. Jinou „nedotknutelnou“ postavou z historie je Martin Luther King. Pořád je tu ale nepřeberné množství dalších celebrit.

TikTok zabil memy

Zástupci OpenAI při zveřejnění Sory mluvili o nevídaných možnostech tvorby edukačních videí a společnost určitě počítá i s možností monetizace programu při tvorbě reklamních videí. Lidé ale zatím používají technologii hlavně k tvorbě krátkých videí, která stojí na drobných variacích vizuálních gagů a fungují jako klasické memy. Každý si může vytvořit vlastní, s nímž se pak spěchá pochlubit na sociální sítě. Lidová tvorba je páteří memové kultury, která žije v neregulované divočině internetu a stojí na kreativitě a snaze být vtipnější (nebo víc „edgy“) než druhý tvůrce či tvůrkyně. A tato hra táhne – OpenAI v říjnu oznámilo, že Soru už používá milion uživatelů, přičemž většina jejích funkcí je placených.

Memová kultura vyrostla za posledních deset let na notoricky populárních a dnes už samozřejmě ohraných obrázkových templates, jako jsou „expanded brain“ (čtyři fáze prozření ilustrované fotografiemi mozku), „distracted boyfriend“ (muž ohlížející se za dívkou, která vypadá úplně stejně jako ta, která kráčí vedle něj) nebo Drake, v němž kanadský rapper na dvou obrázcích projevuje nesouhlas a souhlas s nějakou myšlenkou. Domýšlet znění vtipu vloženého do daného kontextu už je pak na jednotlivých uživatelích.

Internet samozřejmě vygeneroval nespočet dalších memových templates a každý, kdo někdy otevřel sociální sítě, je zná. Studiu memů se už dnes věnují akademici, katalogizují je specializované stránky a od roku 2017 o nich dokonce vycházel tištěný měsíčník Meme Insider, který nicméně letos v květnu ukončil činnost, čímž vlastně potvrdil, že jedna éra memů je nejspíš u konce.

Těžiště internetového humoru se totiž ze sociálních sítí X nebo Facebook přesunulo na TikTok, který je ale ještě více decentralizovaný, a neumožňuje tak, aby některý vtípek překročil hranice omezených bublin a „vybouchl“ do podoby popkulturního fenoménu, jako se to povedlo výše jmenovaným memů nebo virálním postavám, jako byly třeba Hasbulla nebo Khaby Lame. TikTok samozřejmě zpopularizovaly tanečky a lipsync na populární písně, ale obrázkové templates na něm moc nefungovaly. Zato videa generovaná AI jsou pro něj ideálním obsahem.

Kočky a brainrot

S nástupem generativního AI dostala memová kultura úplně novou energii, nebo to tak alespoň poslední měsíce vypadá. Je to fascinující éra, protože se ustanovují nová pravidla toho, co můžeme za memy považovat. Když si odmyslíme všechny problematické aspekty používání umělé inteligence (ať už jde o obrovskou energetickou náročnost technologie, nebo etické aspekty popsané výše), kreativita internetových tvůrců dostala nový nástroj a explodovala jako mozek ve výše zmíněném memu „expanded brain“.

Pokud jde o memy, první vždycky přicházejí kočky, a nejinak to bylo s obsahem generovaným s pomocí programů, jako jsou Midjourney, ElevenLabs nebo DALL-E. „Lidový hrdina“, vychytralý a záludný oranžový kocour pojmenovaný internetem Chubby, hlásí nástup zhruba od začátku loňského roku. Kocour je v příbězích generovaných zmíněnými programy za trickstera, typickou postavu z lidových legend napříč kulturami, „vyčůraného“ požitkáře, kterému nemůžete věřit ani nos mezi očima. V podobné době začaly vznikat také dojemné příběhy antropomorfizovaných kočičích hrdinů vyrovnávajících se s chudobou nebo neštěstím, které často končí morálním poselstvím, jako pohádky.

Krátké příběhy s kočkami ale pořád vypadaly stylizovaně a uměle, jako kdyby šlo o amatérský animovaný film. Jako produkt umělé inteligence jednoznačně působily i krátké skeče s kuchařskou celebritou Gordonem Ramseyem, které stály na prvcích surreálného humoru. Letos v únoru dokonce vznikl i celý film, jehož tvůrce vystupující pod jménem Deranged AI (Vyšinutá AI) tvrdil, že se jedná o vůbec první snímek vygenerovaný kompletně umělou inteligencí. Extrémně rozšířeným trendem letošního jara a léta pak byla videa ze série „Italian Brainrot“ s bizarními postavičkami jako Ballerina Cappuccina (tanečnice s šálkem kávy místo hlavy) nebo Tung Tung Tung Sahur (antropomorfní prkno s basketbalovou pálkou), doplněné navíc chytlavými písněmi patrně také generovanými umělou inteligencí. (Pokud jste se s nimi dosud nesetkali, můžete být jen rádi.) V internetovém světě, kde se tvůrci předhánějí v absurditě, byla fáze „brainrotu“ (doslova mozková plíseň) jen dalším logickým krokem.

Vyšinuté vtípky jsou samozřejmě synonymem memové kultury, když ale ve feedu instagramu nebo TikToku sledujete realisticky vypadající video, na němž fyzik Stephen Hawking jezdí na vozíčku ve skateboardové U-rampě, nebo další, na němž zesnulá anglická královna Alžběta II. demoluje regály v supermarketu, nejspíš vám dojde, že jsme už překročili nějakou hranici. A co bude za ní, to opravdu nikdo neví.

AI jako umění

V povedeném dystopickém sci-fi seriálu stanice HBO Roky a roky, odvysílaném v roce 2019, se ve Velké Británii blízké budoucnosti dostane k moci milionářka a autoritářská politička Vivien Rook v podání Emmy Thompson. Rozhodující volby vyhraje hlavně díky deepfake videím, na nichž členové dvou největších tradičních politických stran říkají zcela nehorázné věci a naštvou si veřejnost. Díky dostupným technologiím OpenAI by se něco takového technicky mohlo stát i v našem světě – nakonec příběh začíná v roce 2024, a tvůrci seriálu tak celkem trefili rok.

Možná nás ale záplava memů s boxujícím Albertem Einsteinem nebo Adolfem Hitlerem křičícím na dopravní policii, která ho zastavila kvůli překročení povolené rychlosti, definitivně naučí nevěřit už vůbec ničemu, co na internetu uvidíme. Třeba tím získáme odstup i vůči falešným slibům politiků nebo reklamních agentur, ale to jsem asi moc velký optimista.

Dystopických scénářů je samozřejmě mnohem víc a je poměrně jasné, že umělá inteligence výrazně změní chod dějin. Jednou možná budeme s láskou vzpomínat na kouzelnou éru, kdy jsme na sociálních sítích mohli scrollovat falešné trailery k neexistujícím filmům společnosti Pixar, jejichž vtípky stojí často na rasistických nebo homofobních stereotypech, nebo bláznivé příběhy Jahmunkey – opice komentující svůj život v rastafariánském patois, kterou už na instagramu sleduje půl milionu uživatelů. Je dokonce tak populární, že už si můžete koupit i její merchandise.

Z trochu jiného soudku jsou experimentální videa digitálního tvůrce Dreamrecordera, který vytváří halucinační, znepokojivé lynchovské fantazie, v nichž lidská těla morfují v želé, rozpadají se nebo se obracejí naruby. Generativní technologie jsou tady už nástrojem uměleckého vyjádření – ostatně třeba česká skupina Rafani s klipy vytvořenými s pomocí AI pracovala na své nedávné výstavě v humpolecké 8smičce.

Smyčka absurdity

Sora2 uspěla i proto, že její interface funguje i jako sociální síť. Na ní se uživatelé mohou svými výtvory chlubit nebo na ně reagovat, což ještě posiluje kompetitivního ducha memové kultury. Na nápad rychle reagovala Meta, která v říjnu spustila sociální síť Vibes pro sdílení videí z Midjourney. Google má prozměnu Veo – nový generativní model (už třetí verzi) i síť stejného jména. Logo Sora2 ale zatím na videích kolujících sociálními sítěmi vítězí.

„Je ještě brzy na to, abychom mohli konstatovat, jestli Sora přežije. Ale OpenAI nejspíš vytvořila typ produktu, který společnosti jako Meta nebo X marně hledají: způsob, jak umělou inteligenci přivést k masám, takže ji lidé mohou sdílet, povzbuzují jeden druhého k vytváření postů a pravidelně používají své aplikace a služby,“ psal v polovině října deník New York Times a vystihl tak důležitý prvek, který nová technologie potřebuje k tomu, aby se skutečně etablovala – musí lidi bavit, aby si za zdroj zábavy byli ochotni i zaplatit.

Oblíbeným metavtípkem jsou teď videa podcasterů, kteří se dívají na videa a hádají, jestli jsou skutečná, nebo je to produkt umělé inteligence. Někdy už je to opravdu těžké rozeznat. V jedné variantě sedí před monitorem dvě mluvící kočky. Nikdy se netrefí, a ještě navíc jsou samy výtvorem softwaru. Tady už se ocitáme ve zvláštní smyčce, ze které bude brzy těžké vykouknout. Jednou budou muset přijít historici memové kultury a zmapovat naši divokou éru. Anebo to už umělá inteligence udělá za nás.

Tento článek mohl vzniknout jen díky podpoře čtenářů

Podpořte nás

Karel Veselý je kulturní publicista a spisovatel. V Alarmu působí od září 2023, píše o hudbě, seriálech, filmu a dalších tématech spojených s popkulturou. Spolu s Michaelou Peštovou a Norou Třískovou vytváří podcast Soundsystem. [email protected]