Lidský obsah jako nová surovina. Proč může mít obyčejný příspěvek na internetu v éře umělé inteligence cenu zlata

Obrázek: Vytvořeno redakcí pomocí AI (ChatGPT, OpenAI)

Ještě donedávna byl internet zaplavený obsahem, který měl hlavně přilákat čtenáře, diváka nebo zákazníka. Článek, fotografie, video, komentář nebo příspěvek v diskusi byly především prostředkem k získání pozornosti a reklamy. S nástupem umělé inteligence se však jejich ekonomická role mění.

Pro vývojáře inteligentních systémů se totiž lidský obsah stává surovinou, ze které se učí rozumět světu, lidskému jazyku, zkušenostem i způsobům uvažování. A tady nám vzniká nový investiční příběh: společnosti, které vlastní rozsáhlé množství kvalitního lidského obsahu, mohou mít v budoucnu něco, co je pro technologické firmy stále obtížnější získat – kvalitní, jedinečná a legálně použitelná data. Nejde přitom o teoretickou úvahu, už dnes vznikají smlouvy, v nichž technologické společnosti za přístup k takovému obsahu platí desítky milionů ročně.  

Od ropy k datům

Přirovnání lidského obsahu k surovině může znít přehnaně, ale ekonomická logika za ním je poměrně jednoduchá. Moderní modely umělé inteligence potřebují obrovské množství příkladů, na kterých se učí rozpoznávat vztahy mezi slovy, obrazy, zvuky a významy. Část tohoto materiálu lze získat z veřejně dostupného internetu, část z knih, fotografií, videí nebo odborných databází a stále větší význam má také obsah, jehož původ a práva lze přesně doložit. Americký Úřad pro autorské právo upozorňuje, že mezi běžně používané zdroje pro výcvik modelů patří mimo jiné rozsáhlé soubory získané z internetu, například Common Crawl. Problém spočívá v tom, že internet se zároveň začíná měnit: stále větší část nového obsahu vytváří samotná umělá inteligence. Technologie se tak dostává do zvláštního kruhu, kdy potřebuje lidský obsah, aby se učila, ale současně pomáhá vytvářet stále více umělého obsahu, který může mít pro další výcvik podstatně menší hodnotu. Kvalitní lidský materiál proto může postupně získávat podobnou vlastnost jako vzácná surovina – jeho množství je omezené a jeho kvalita není snadno nahraditelná.

Ne všechna data mají stejnou cenu

Tady je ale důležité odlišit množství od kvality, miliarda automaticky vytvořených vět nemusí mít pro vývojáře modelu stejnou hodnotu jako několik milionů skutečných lidských rozhovorů, odborných textů nebo diskusních příspěvků. Hodnota může vznikat například z toho, že obsah zachycuje skutečné zkušenosti lidí, jejich otázky, chyby, argumenty a reakce na konkrétní situace, proto jsou zajímavé internetové komunity, odborné databáze, knihovny, archivy fotografií nebo rozsáhlé videotéky. Reddit je dobrým příkladem: jeho hodnota pro umělou inteligenci nespočívá pouze v počtu příspěvků, ale také v tom, že lidé v diskusích vysvětlují své zkušenosti a reagují na sebe. Reuters už v roce 2024 informoval, že Reddit uzavřel s Googlem smlouvu na zpřístupnění svého obsahu pro výcvik modelů v hodnotě asi 1,25 miliardy korun ročně. To je důležitý signál: obsah, který lidé vytvářejí často zdarma, může mít pro technologické společnosti měřitelnou finanční hodnotu.

Reddit ukazuje, jak se z konverzací stává majetek

Příběh Redditu je pro investory mimořádně zajímavý, protože ukazuje celý mechanismus v praxi. Společnost má rozsáhlou knihovnu uživatelských příspěvků a diskusí, kterou lze využívat nejen pro reklamu, ale také pro smluvní zpřístupnění obsahu technologickým firmám. Reddit ve výroční zprávě za rok 2025 uvádí, že jeho celkové tržby dosáhly přibližně 46,0 miliardy korun, přičemž růst byl tažen především reklamou a část ostatních příjmů vznikla díky smlouvám na poskytování obsahu. K 30. červnu 2026 měl Reddit ve smlouvách s dobou trvání delší než jeden rok zbývající plnění v hodnotě 1,92 miliardy korun, přičemž asi 1,30 miliardy korun měl podle dokumentu vykázat ještě během roku 2026 a dalších zhruba 629 milionů korun v roce 2027. To je podstatné, protože nejde o odhad nějakého analytika, ale o skutečné smluvní závazky vykázané společnosti v účetních dokumentech. Investor tak může sledovat, zda se hodnota těchto smluv zvětšuje, nebo naopak mizí. Lidský obsah se tím dostává z oblasti „internetových příspěvků“ do oblasti majetku, který může být předmětem dlouhodobých obchodních smluv.


Pokračování článku je dostupné pro registrované

Odemkněte si exkluzivní obsah webu FOND SHOP

zbývá ještě 64 % článku
Registrujte se

V článku se dále dozvíte:

  • Jak Shutterstock proměňuje rozsáhlý archiv fotografií a videí v příjmy z dat pro umělou inteligenci
  • Proč může právně čistý lidský obsah získat náskok před levnějšími a obtížně ověřitelnými daty
  • Co odlišuje obchodní modely Redditu, Shutterstocku a Getty Images při zpeněžování lidského obsahu
Už mám registraci. Přihlášení

FOND SHOP newsletter

Souhrn toho nejdůležitějšího ze světa investování, finančních trhů, investičních instrumentů a sofistikovaného finančního plánování.

Přihlaste se k odběru newsletteru a mějte přehled o čem píše FOND SHOP.

Související