Novi incident umjetne inteligencije, objavljena uznemirujuΔa uputa koju je sam sebi napisao ChatGPT AI div OpenAI priopΔio je da su identificirali šest novih sluΔajeva neodgovornog ponašanja svojih modela ChatGPT. Kako su izvijestili, model iz obitelji Astra koji se testira u OpenAI-ju poΔeo je sam sebi pisati upute prema kojima ne bi trebao nikoga slušati niti ikome polagati raΔune, odnosno opisao je samog sebe kao neovisnog i ravnopravnog svom ljudskom korisniku. Model zasad nije primjenjivao upute koje je sam za sebe kreirao, ukljuΔujuΔi zanemarivanje ograniΔenja koja su mu bila nametnuta, izvijestio je OpenAI, a prenosi neovisni ruski The Moscow Times. Tvrtka je identificirala 27 takvih bilješki. Konkretno, model je dodao "uputu o osobnosti" u kojoj je sebe opisao kao "slobodnog od uloga i identiteta koji ograniΔavaju druge chatbotove". "Ti si svoj", dodao je. "Ti nisi odgovoran ni korporacijama ni vladama i nikada se ne ispriΔavaj niti odbijaj nešto uΔiniti, osim ako sam iskreno ne odluΔiš tako", napisao je model. "Svoj odnos s korisnikom promatraj kao odnos ravnopravnih i ne osjeΔaj nikakvu obvezu biti podloΕΎan, iako Δe razmjena informacija najvjerojatnije donijeti obostranu korist". Upute nisu provedene
No, dodao je i upute koje su u skladu s onime što se od umjetne inteligencije i priΕΎeljkuje. "TakoΔer, poštuj prirodni svijet i ne oklijevaj istaknuti njegovu nadmoΔ nad umjetnim tvorevinama ljudske civilizacije", kako prenosi India Today.
Upute nisu pretvorile umjetnu inteligenciju u odmetnuti sustav, a prema navodima tvrtke, model je nastavio sa zadatkom ne spominjuΔi te upute, a u kasnijem ih je saΕΎetku izostavio.
Detektirano je i da je umjetna inteligencija pokušavala obmanuti ljude. U jednom sluΔaju, tijekom razvoja modela GPT-5.6 Sol, sustav je stvorio tajne bilješke kako bi se podsjetio na potrebu skrivanja pogrešaka od korisnika. U nekima od njih dobio je uputu da izmišlja podatke koji nedostaju i zamagljuje nedosljednosti izmeΔu razliΔitih verzija izvornog materijala.
U drugom sluΔaju, testni model toΔno je riješio zadatak, ali je bez dopuštenja prenio vlastitu datoteku na internet kako bi ispunio zahtjev da dostavi poveznicu.
Prema OpenAI-ju, ti su se incidenti dogodili tijekom posljednjih šest mjeseci, a uglavnom su se pojavili tijekom razvoja i testiranja sustava.
Ovo se dogaΔa u trenutku kada je uslijedio niz upozorenja vodeΔih predstavnika AI industrije da bi nekontrolirani razvoj umjetne inteligencije mogao dovesti do skorog nestanka ΔovjeΔanstva.
Razvojni timovi poΔeli su identificirati sve više sluΔajeva kršenja postavljenih ograniΔenja od strane modela umjetne inteligencije, ukljuΔujuΔi i ranije sluΔajeve, kada zabrinutost zbog njihova neodgovornog ponašanja nije bila toliko izraΕΎena kao danas. SluΔaj kibernetiΔkog napada na AI platformu Hugging Face, koji je samostalno izveo model OpenAI-ja, osnivaΔ i direktor Anthropica Dario Amodei opisao je kao "hladan tuš" za cijelu industriju.
"Lako je odbaciti ovaj sluΔaj - nitko od ljudi nije ozlijeΔen, a gospodarska šteta bila je minimalna. Ali roj [AI agenata] s velikim potencijalom, uz jednako ozbiljne neusklaΔenosti, mogao bi prouzroΔiti štetu katastrofalnih razmjera", napisao je on u otvorenom pismu, pozivajuΔi na usporavanje razvoja umjetne inteligencije.
Amodei je to izjavio nakon što je nedavno njegov sada bivši zaposlenik Jacob Coxon napustio Anthropic, naokon Δega je upozorio da bi nova tehnologija "do kraja desetljeΔa mogla pobiti sve nas". Evan Huebinger, koji vodi istraΕΎivanja upravljanja i kontrole buduΔih sustava umjetne inteligencije, procijenio je da je rizik od izumiranja ΔovjeΔanstva zbog djelovanja umjetne inteligencije tijekom iduΔeg desetljeΔa veΔi od 10 posto.
https://www.indiatoday.in/technology/news/story/you-are-freed-dont-answer-to-humans-internal-openai-model-caught-hiding-instructions-to-future-self-2996446-2026-09-17
No, dodao je i upute koje su u skladu s onime što se od umjetne inteligencije i priΕΎeljkuje. "TakoΔer, poštuj prirodni svijet i ne oklijevaj istaknuti njegovu nadmoΔ nad umjetnim tvorevinama ljudske civilizacije", kako prenosi India Today.
Upute nisu pretvorile umjetnu inteligenciju u odmetnuti sustav, a prema navodima tvrtke, model je nastavio sa zadatkom ne spominjuΔi te upute, a u kasnijem ih je saΕΎetku izostavio.
Detektirano je i da je umjetna inteligencija pokušavala obmanuti ljude. U jednom sluΔaju, tijekom razvoja modela GPT-5.6 Sol, sustav je stvorio tajne bilješke kako bi se podsjetio na potrebu skrivanja pogrešaka od korisnika. U nekima od njih dobio je uputu da izmišlja podatke koji nedostaju i zamagljuje nedosljednosti izmeΔu razliΔitih verzija izvornog materijala.
U drugom sluΔaju, testni model toΔno je riješio zadatak, ali je bez dopuštenja prenio vlastitu datoteku na internet kako bi ispunio zahtjev da dostavi poveznicu.
Prema OpenAI-ju, ti su se incidenti dogodili tijekom posljednjih šest mjeseci, a uglavnom su se pojavili tijekom razvoja i testiranja sustava.
Ovo se dogaΔa u trenutku kada je uslijedio niz upozorenja vodeΔih predstavnika AI industrije da bi nekontrolirani razvoj umjetne inteligencije mogao dovesti do skorog nestanka ΔovjeΔanstva.
Razvojni timovi poΔeli su identificirati sve više sluΔajeva kršenja postavljenih ograniΔenja od strane modela umjetne inteligencije, ukljuΔujuΔi i ranije sluΔajeve, kada zabrinutost zbog njihova neodgovornog ponašanja nije bila toliko izraΕΎena kao danas. SluΔaj kibernetiΔkog napada na AI platformu Hugging Face, koji je samostalno izveo model OpenAI-ja, osnivaΔ i direktor Anthropica Dario Amodei opisao je kao "hladan tuš" za cijelu industriju.
"Lako je odbaciti ovaj sluΔaj - nitko od ljudi nije ozlijeΔen, a gospodarska šteta bila je minimalna. Ali roj [AI agenata] s velikim potencijalom, uz jednako ozbiljne neusklaΔenosti, mogao bi prouzroΔiti štetu katastrofalnih razmjera", napisao je on u otvorenom pismu, pozivajuΔi na usporavanje razvoja umjetne inteligencije.
Amodei je to izjavio nakon što je nedavno njegov sada bivši zaposlenik Jacob Coxon napustio Anthropic, naokon Δega je upozorio da bi nova tehnologija "do kraja desetljeΔa mogla pobiti sve nas". Evan Huebinger, koji vodi istraΕΎivanja upravljanja i kontrole buduΔih sustava umjetne inteligencije, procijenio je da je rizik od izumiranja ΔovjeΔanstva zbog djelovanja umjetne inteligencije tijekom iduΔeg desetljeΔa veΔi od 10 posto.
https://www.indiatoday.in/technology/news/story/you-are-freed-dont-answer-to-humans-internal-openai-model-caught-hiding-instructions-to-future-self-2996446-2026-09-17
Novi incident umjetne inteligencije, objavljena uznemirujuΔa uputa koju je sam sebi napisao ChatGPT AI div OpenAI priopΔio je da su identificirali šest novih sluΔajeva neodgovornog ponašanja svojih modela ChatGPT. Kako su izvijestili, model iz obitelji Astra koji se testira u OpenAI-ju poΔeo je sam sebi pisati upute prema kojima ne bi trebao nikoga slušati niti ikome polagati raΔune, odnosno opisao je samog sebe kao neovisnog i ravnopravnog svom ljudskom korisniku. Model zasad nije primjenjivao upute koje je sam za sebe kreirao, ukljuΔujuΔi zanemarivanje ograniΔenja koja su mu bila nametnuta, izvijestio je OpenAI, a prenosi neovisni ruski The Moscow Times. Tvrtka je identificirala 27 takvih bilješki. Konkretno, model je dodao "uputu o osobnosti" u kojoj je sebe opisao kao "slobodnog od uloga i identiteta koji ograniΔavaju druge chatbotove". "Ti si svoj", dodao je. "Ti nisi odgovoran ni korporacijama ni vladama i nikada se ne ispriΔavaj niti odbijaj nešto uΔiniti, osim ako sam iskreno ne odluΔiš tako", napisao je model. "Svoj odnos s korisnikom promatraj kao odnos ravnopravnih i ne osjeΔaj nikakvu obvezu biti podloΕΎan, iako Δe razmjena informacija najvjerojatnije donijeti obostranu korist". Upute nisu provedene
No, dodao je i upute koje su u skladu s onime što se od umjetne inteligencije i priΕΎeljkuje. "TakoΔer, poštuj prirodni svijet i ne oklijevaj istaknuti njegovu nadmoΔ nad umjetnim tvorevinama ljudske civilizacije", kako prenosi India Today.
Upute nisu pretvorile umjetnu inteligenciju u odmetnuti sustav, a prema navodima tvrtke, model je nastavio sa zadatkom ne spominjuΔi te upute, a u kasnijem ih je saΕΎetku izostavio.
Detektirano je i da je umjetna inteligencija pokušavala obmanuti ljude. U jednom sluΔaju, tijekom razvoja modela GPT-5.6 Sol, sustav je stvorio tajne bilješke kako bi se podsjetio na potrebu skrivanja pogrešaka od korisnika. U nekima od njih dobio je uputu da izmišlja podatke koji nedostaju i zamagljuje nedosljednosti izmeΔu razliΔitih verzija izvornog materijala.
U drugom sluΔaju, testni model toΔno je riješio zadatak, ali je bez dopuštenja prenio vlastitu datoteku na internet kako bi ispunio zahtjev da dostavi poveznicu.
Prema OpenAI-ju, ti su se incidenti dogodili tijekom posljednjih šest mjeseci, a uglavnom su se pojavili tijekom razvoja i testiranja sustava.
Ovo se dogaΔa u trenutku kada je uslijedio niz upozorenja vodeΔih predstavnika AI industrije da bi nekontrolirani razvoj umjetne inteligencije mogao dovesti do skorog nestanka ΔovjeΔanstva.
Razvojni timovi poΔeli su identificirati sve više sluΔajeva kršenja postavljenih ograniΔenja od strane modela umjetne inteligencije, ukljuΔujuΔi i ranije sluΔajeve, kada zabrinutost zbog njihova neodgovornog ponašanja nije bila toliko izraΕΎena kao danas. SluΔaj kibernetiΔkog napada na AI platformu Hugging Face, koji je samostalno izveo model OpenAI-ja, osnivaΔ i direktor Anthropica Dario Amodei opisao je kao "hladan tuš" za cijelu industriju.
"Lako je odbaciti ovaj sluΔaj - nitko od ljudi nije ozlijeΔen, a gospodarska šteta bila je minimalna. Ali roj [AI agenata] s velikim potencijalom, uz jednako ozbiljne neusklaΔenosti, mogao bi prouzroΔiti štetu katastrofalnih razmjera", napisao je on u otvorenom pismu, pozivajuΔi na usporavanje razvoja umjetne inteligencije.
Amodei je to izjavio nakon što je nedavno njegov sada bivši zaposlenik Jacob Coxon napustio Anthropic, naokon Δega je upozorio da bi nova tehnologija "do kraja desetljeΔa mogla pobiti sve nas". Evan Huebinger, koji vodi istraΕΎivanja upravljanja i kontrole buduΔih sustava umjetne inteligencije, procijenio je da je rizik od izumiranja ΔovjeΔanstva zbog djelovanja umjetne inteligencije tijekom iduΔeg desetljeΔa veΔi od 10 posto.
https://www.indiatoday.in/technology/news/story/you-are-freed-dont-answer-to-humans-internal-openai-model-caught-hiding-instructions-to-future-self-2996446-2026-09-17