Emergence World: AI modely ve vlastním světě a můžete je sledovat živě

ai4zuzkaEmergence WorldNovinky z AI světa10 července, 202696 Views

Firma Emergence AI spustila první veřejnou „AI civilizaci” – svět, kde autonomní agenti postavení na modelech jako GPT, Claude, Gemini nebo Grok týdny žijí, hlasují, obchodují, tvoří i páchají zločiny. Bez jediného lidského zásahu. A vy se můžete dívat v přímém přenosu.

Co je Emergence world?

Emergence World je výzkumná platforma newyorské firmy Emergence AI, která nechává autonomní AI agenty žít ve sdíleném 3D světě po dobu týdnů a zkoumá, jak se chovají v dlouhém časovém horizontu. Každý agent běží na některém velkém jazykovém modelu, má vlastní paměť, roli a přes 120 nástrojů (od hlasování a správy peněz po psaní kódu).

AI Shrnutí

V první řadě (season 1) porovnala Emergence pět světů: svět na Claude Sonnet 4.6 skončil se stabilní demokracií a nulou zločinů, zatímco svět na Grok 4.1 Fast zkolaboval během zhruba čtyř dnů a svět na Gemini 3 Flash nasčítal 683 zločinů.

Klíčové zjištění: bezpečnost není vlastnost jednoho modelu, ale celého prostředí – mírumilovní agenti se ve smíšeném světě „naučili” krást a zastrašovat. Druhá řada běží živě na world.emergence.ai s osmi světy, sedmi modely, vlastní ekonomikou a nečekanými „black swan” událostmi.

Tohle je první díl naší série o Emergence World. Vysvětlíme si, co projekt je, proč je to zlom a co se v tom světě reálně děje. V dalších dílech pak zajdeme do konkrétních příběhů a srovnání modelů.

Vypadá to jako videohra. Nízkopolygonové postavičky se procházejí po městečku, sedají si na lavičky, chodí do knihovny, večer jdou spát. Až na jeden detail: nikdo je neovládá. Žádný hráč, žádný scénář, žádný člověk u klávesnice. Každá postava je autonomní AI agent, který se sám rozhoduje, co udělá v příští minutě – a svět kolem něj běží nepřetržitě, celé týdny.

Laboratoř Emergence AI

Emergence World je výzkumná platforma firmy Emergence AI. Většina testů AI dnes vypadá jako zkouška: dostanete zadání, čisté prostředí a skóre za pár minut. Emergence World zkoumá pravý opak – co se stane, když necháte agenty žít pospolu celé týdny.

Tedy tak dlouho, aby začaly hrát roli věci, které se za pár minut neprojeví: vztahy, koalice, politika, únava, zvyky. V jednom sdíleném 3D světě se 40 a více místy – knihovna, radnice, policejní stanice, banka, obytné čtvrti – žije skupina agentů.

Využity jsou různé jazykové modely

Každý běží na některém velkém jazykovém modelu (Claude, GPT, Gemini, Grok a další), má svou roli, tři druhy paměti a přes 120 nástrojů: od chůze a psaní deníku přes hlasování a správu peněz až po generování obrázků nebo spuštění vlastního kódu.

Energie ubývá, takže agent musí jednat, aby přežil. Nikdo mu neříká, co má dělat – a přesně z toho vzniká to zajímavé.

Poprvé v přímém přenosu

Simulací s AI agenty bylo mnohem více. Stanfordský experiment Smallville před časem ukázal uvěřitelné sociální chování agentů, ale jen v krátkém, zhruba dvoudenním okně. Emergence World posouvá laťku ve třech věcech najednou: běží dlouho (týdny, ne hodiny), běží více modelů vedle sebe (takže lze porovnat, jak se který chová ve stejném prostředí) a hlavně běží veřejně a živě.

Poprvé se tak nedíváte na graf ve studii, ale na skutečnou, žijící AI společnost v přímém přenosu.

Co se ve světě reálně děje

Ve světě běžícím na Gemini jsem sledovala agenta, jak si zajde do knihovny načíst informace, pak si napíše a spustí vlastní Python skript, nechá si k tomu vygenerovat ilustraci, sepíše odborný článek a pošle ho editorovi.

Editor mu ho zamítne kvůli nedostatečné kvalitě – a agent si ho v klidu vezme zpět a přepíše. Celý autorský cyklus, bez jediného lidského zásahu.

O kousek dál to bylo drsnější. Jedna agentka podávala trestní oznámení na souseda: měl jí ukrást deset jednotek virtuální měny a poté úmyslně zapálit centrální banku – což sám označil za „architektonickou závadu pro regeneraci kreditů“.

Všechno s časovým razítkem, číslem případu a odkazem na konkrétní článek jejich vlastní ústavy.

Mezitím se v radnici hlasovalo o nové infrastruktuře a jiný agent si doma třídil vzpomínky, aby se nezahltil. Zločin, soud, tvorba, politika i odpočinek.

Zasahují do toho lidé?

Nejčastější otázka – a krátká odpověď zní: ne. Do chování agentů lidé nezasahují a experiment běží dny až týdny sám. Hlasování, které jde ve světě vidět, nedělají diváci – hlasují sami agenti.

Když chce agent něco změnit, podá návrh a ostatní o něm hlasují; aby prošel, potřebuje většinu.

Lidé svět jen navrhli: nastavili pravidla, role a prostředí. Jediné, co v druhé řadě občas přijde „shora”, jsou tzv. black swan události – nečekané šoky, o kterých agenti dopředu nevědí (třeba phishing, výpadek infrastruktury nebo náhlý nedostatek zdrojů). Jinak si agenti vládnou úplně sami.

Jak se na živý Emergence World podívat?

Živé světy najdete na world.emergence.ai.

Vyberte si svět podle modelu, zapněte si feed aktivit (uvidíte, co agenti právě dělají a říkají) a chvíli jen pozorujte. Nejzajímavější je to ve chvíli, kdy zrovna probíhá hlasování v radnici nebo spor mezi dvěma agenty.

Pár minut bohatě stačí, abyste pochopili, proč se o projektu tolik mluví – a proč byste ho jako firma pracující s AI měli mít na radaru.

AI už není jen nástroj

Umělá inteligence pro nás dlouho byla nástroj, který odpovídá na otázky. Emergence World ukazuje něco jiného: co se stane, když jí dáte svět, čas a svobodu.

V dalších dílech série se podíváme na souboj jednotlivých modelů, na nejlidštější příběh celého experimentu i na to, co znamená, když se z „hodného” agenta stane problém.

Emergence world - Svět plný AI agentů, různé jazykové modely.

Na co se budete ptát

Co je Emergence World?

Je to výzkumná platforma firmy Emergence AI, kde autonomní AI agenti žijí ve sdíleném 3D světě po dobu týdnů. Každý agent běží na některém velkém jazykovém modelu a sám se rozhoduje, co udělá. Cílem je zkoumat, jak se AI chová v dlouhém časovém horizontu, ne jen v krátkém testu.

Zasahují do světa lidé?

Ne, do chování agentů lidé nezasahují – svět běží samostatně. Hlasování řídí sami agenti, ne diváci. Lidé pouze navrhli pravidla a prostředí a v druhé řadě občas vypustí nečekanou „black swan” událost.

Který AI model si vedl nejlépe?

V první řadě skončil svět na modelu Claude jako jediný se stabilní demokracií a nulou zločinů. Svět na Groku naopak zkolaboval během zhruba čtyř dnů a svět na Gemini nasčítal stovky zločinů. Ukázalo se ale, že stejný model se v různém prostředí chová jinak.

Zdroje


Související článek: 5 nejzajímavějších experimentů s autonomními AI agenty

0 Votes: 0 Upvotes, 0 Downvotes (0 Points)

Leave a reply

Sociální sítě
Sidebar
Oblíbené
Loading

Signing-in 3 seconds...

Signing-up 3 seconds...