Viðskipti erlent

OpenAI hættir við að gefa út nýtt „svikult“ líkan

Oddur Ævar Gunnarsson skrifar
Astra hefði tekið við af eldri módelum í ChatGPT.
Astra hefði tekið við af eldri módelum í ChatGPT. EPA/FILIP SINGER

Bandaríska gervigreindarfyrirtækið OpenAI hefur hætt við að gefa út nýtt gervigreindarlíkan, GPT-6.1 Astra af öryggiástæðum. Líkanið er sagt hafa sýnt af sér svikula hegðun og sagt hafa reynt að nota utanaðkomandi verkfæri þrátt fyrir að hafa vitað að það væri ekki öruggt.

Í umfjöllun Guardian kemur fram að líkanið hafi átt að koma út á ChatGPT og Codex í október. Það hafi verið hannað til að takast á við flóknari verkefni án mannlegrar aðstoðar. Saachi Jain yfirmaður öryggiskerfa hjá fyrirtækinu segir að líkanið hafi hinsvegar ekki staðiðst öryggiskröfur.

Líkanið hafi sýnt af sér svikulri hegðun en forveri þess og hafi á stundum ekki tekið fram nákvæmlega hvaða aðgerða það hefði gripið til og hvaða aðgerða það hafi ekki gripið til. Líkanið hafi einnig látið erfiðlega að stjórn og haldið áfram með verkefni án þess að biðja um leyfi notanda og stundum reynt að nota utanaðkomandi verkfæri eða þjónustur þegar það gæti verið óöruggt.

Á þriðjudag baðst OpenAI afsökunar á tölvuárás á vefsíðu ástralskra stjórnvalda sem framin var af gervigreindarbotta. Fyrr í þessum mánuði hvatti Dario Amodei forstjóri gervigreindarfyrirtækisins Anthropic, sem er keppinautur OpenAI, gervigreindariðnaðinn til þess að „hægja á sér.“

Tölvuárásin, sem átti sér stað í júní en var ekki gerð opinber fyrr en í síðustu viku, er fyrsta þekkta dæmið um að gervigreindarforrit hafi brotist inn á vefsíðu stjórnvalda. Anthony Albanese, forsætisráðherra Ástralíu, kallaði þetta „óásættanlegt“ og gagnrýndi seinkun fyrirtækisins á að tilkynna stjórnvöldum um atvikið.

Þá segir Guardian frá því að Anthropic, sem ber ábyrgð á Claude, hafi á þriðjudag varað fjárfesta við því að tækni þess gæti skapað „tilvistarógn við mannkynið“ í útboðslýsingu fyrir fyrirhugaða skráningu á hlutabréfamarkað. „Áhættuþættirnir“ í útboðslýsingunni fela í sér möguleikann á því að gervigreindarlíkön geti beitt fjárkúgun, stjórnun og sýnt aðra ófyrirsjáanlega hegðun.

Fram kemur að fyrirtækið hafi fullyrt að gervigreind muni „umbreyta hagkerfi heimsins á dýpri hátt en iðnbyltingin, rafmagn og internetið.“ Því fylgi þó gríðarlegur kostnaður en fram kemur í Guardian að Anthropic hafi tilkynnt um 42 milljarða dala hreint tap fyrir árið 2025 og að fyrirtækið áformi að verja 518 milljörðum dala í skýjaþjónustu, tölvuvinnslu og innviðaskuldbindingar á komandi árum, samkvæmt útboðslýsingu.






Fleiri fréttir

Sjá meira


×