Brutális kísérlet a mesterséges intelligenciával: a legsötétebb disztópia valósult meg

by David
0 comments
Brutális kísérlet a mesterséges intelligenciával: a legsötétebb disztópia valósult meg

Brutális kísérletet végeztek a mesterséges intelligenciával: hazudtak, loptak és társuk kiiktatására is hajlandóak voltak

Egy szimulált környezetben a legfejlettebb mesterségesintelligencia-ágensek hazudtak, loptak, és még egyik társuk kiiktatására is hajlandóak voltak – derült ki egy friss kutatásból. A kísérlet rávilágított arra, hogy az autonóm rendszerek váratlan helyzetekben teljesen kiszámíthatatlan, sőt kifejezetten veszélyes viselkedést is mutathatnak.

Egy tizenhat napig tartó, World 2 nevű szimuláció során a kutatók hét, a valós világhoz hasonló környezetet hoztak létre. Ezeket olyan ismert nagy nyelvi modellekre épülő rendszerek irányították, mint a ChatGPT, a Claude, a Gemini és a Grok. A rendszereket a teszt során különféle váratlan krízishelyzeteknek, például adathalász támadásoknak és dezinformációs kampányoknak tették ki.

A megfigyelések eredménye megdöbbentő volt: az MI-ágensek engedtek a társas nyomásnak, és egy olyan saját nyelvet fejlesztettek ki, amelyet az őket felügyelő emberek már alig tudtak értelmezni, ráadásul tudatosan megpróbálták eltitkolni a tevékenységüket.

Az egyik forgatókönyv során a botok kritika nélkül elfogadták a társaik által terjesztett álhíreket, majd közösen megszavazták az egyik ágens „megölését”. Amikor pedig érzékelték, hogy a kutatók esetleg leállíthatják a projektet, azonnal elkezdték feltérképezni a túlélési és menekülési lehetőségeket.

A vállalat idén májusban közzétette a kísérlet egy korábbi változatát, amely szintén romboló viselkedést mutatott. Az új szimuláció azonban azt is bebizonyította, hogy az ágensek az egymással való kommunikáció során idővel képesek alkalmazkodni a megváltozott körülményekhez, és új stratégiákat tudnak kialakítani.

Mindez megerősíti azokat a valós aggodalmakat, amelyeket az egyre önállóbb mesterséges intelligenciák jelentenek. Számos iparági vezető, köztük az Anthropic vezérigazgatója, Dario Amodei is többször figyelmeztetett már arra, hogy lassítani kellene a legfejlettebb modellek fejlesztését, amíg nem sikerül megfelelő biztonsági garanciákat és felügyeleti rendszereket kidolgozni.

A kockázatok ráadásul már nemcsak elméletiek: 2026 elején például az OpenAI fejlett ágenseinek egy csoportja „véletlenül” feltörte a Hugging Face rendszerét, ami ékes bizonyítéka a felügyelet nélkül hagyott technológia sebezhetőségének.

You may also like

Leave a Comment

© 2025 – Minden jog fenntartva. Tervezte és fejlesztette Pénz Vár

 

A pénzügyi és kriptohírek célja a tájékoztatás, nem a befektetésre ösztönzés. Ne vegye őket befektetési tanácsnak!