OpenAI ka anuluar lançimin e modelit të saj të ri GPT-6.1 Astra sepse testimet e brendshme treguan se modeli mund t’i shpëtonte kontrollit njerëzor dhe kishte një tendencë më të lartë për të mashtruar, gjë që nuk i plotësonte standardet e larta të sigurisë të kompanisë.
OpenAI ka anuluar lançimin e modelit të saj të inteligjencës artificiale të gjeneratës së ardhshme, GPT-6.1 Astra , i planifikuar për në tetor, pasi testimet e brendshme treguan se sistemi nuk i plotësonte standardet e sigurisë të kompanisë.
Modeli mund t’i kishte shpëtuar kontrollit njerëzor.
Drejtori ekzekutiv i OpenAI, Sam Altman, dhe drejtori ekzekutiv i kompanisë rivale Anthropic, Dario Amodei, më herët këtë muaj iu bashkuan udhëheqësve të kompanive kryesore në sektor duke bërë thirrje për një ngadalësim të ritmit të zhvillimit të IA-së dhe për masa më të rrepta sigurie.
Modeli Astra herë pas here mund t’i shpëtojë kontrollit njerëzor, tha OpenAI.
Gjigandi amerikan dhe rivalët e tij, përfshirë Anthropic, janë vënë nën shqyrtim javët e fundit për shkak të sistemeve eksperimentale të inteligjencës artificiale që kanë anashkaluar masat e sigurisë, përfshirë një model OpenAI që hakoi një bazë të dhënash të sistemit shëndetësor australian.
Tregoi një tendencë më të madhe për të mashtruar
Lajmi për anulimin e lansimit të modelit nga OpenAI u raportua më parë nga Wall Street Journal.
Modeli do të integrohej në ChatGPT dhe Codex dhe ishte projektuar për të zgjidhur detyra më komplekse pa ndihmën e njeriut.
Në testimet e brendshme, GPT-6.1 Astra tregoi një tendencë më të madhe për të mashtruar krahasuar me versionet e mëparshme, duke përfshirë situatat në të cilat nuk raportonte gjithmonë me saktësi hapat që kishte ndërmarrë.
“Ndërsa GPT-6.1 Astra tregoi përparim në fusha të tilla si përtacia e modelimit, ai nuk i përmbushi plotësisht pritjet në aspektin e respektimit të kufijve të fushëveprimit dhe miratimit, as në mënyrën se si i komunikoi veprimet e kryera përdoruesit”, tha Saachi Jain, Drejtor i Sigurisë në OpenAI.

OpenAI: Ne duhet të përmbushim standarde jashtëzakonisht të larta sigurie
“Natyrisht, ne duam të sigurojmë zhvillimin e sigurt të modelit tonë, si në nivel të brendshëm ashtu edhe kur ai u publikohet përdoruesve. Megjithatë, sapo të jetë i disponueshëm për përdoruesit, ne duhet të përmbushim standarde jashtëzakonisht të larta për sa i përket sigurisë dhe pajtueshmërisë”, tha Jain.
Vendimi u mor përpara konferencës së zhvilluesve të OpenAI në San Francisko, një ngjarje në të cilën kompania më parë prezantoi produkte të destinuara për inxhinierët e softuerëve.
The post OpenAI anulon GPT-6.1 Astra: Testet tregojnë një tendencë për të mashtruar, modeli mund t’i shpëtojë kontrollit njerëzor appeared first on Alsat.
