Zadnje objave

Možda vam se sviđa

Astra model uskoro stiže: OpenAI ograničava njegove najnaprednije mogućnosti

OpenAI je objavio nove detalje o modelu Astra, koji bi uskoro trebao postati dostupan korisnicima. Tvrtka ga opisuje kao prvi veliki jezični model koji je dosegao „kritični prag kibernetičke sigurnosti“.

Astra model može samostalno pronaći nepoznate sigurnosne propuste u računalnim sustavima. Također ih može iskoristiti bez ljudskog vodstva. Zbog toga će pristup njegovim najnaprednijim mogućnostima biti ograničen.

Što Astra model može učiniti?

OpenAI tvrdi da Astra može otkriti sigurnosne ranjivosti koje prethodno nisu bile poznate. Model ih zatim može samostalno iskoristiti.

Sličnu zabrinutost ranije je izrazio Anthropic u vezi sa svojim modelom Mythos. OpenAI zato uvodi dodatne mjere zaštite prije službenog predstavljanja Astre.

Tvrtka će model prvo ponuditi odabranoj skupini testera. Ipak, nije otkrila tko će sudjelovati u testiranju ni prema kojim kriterijima će ih birati.

Savršen rezultat na sigurnosnom testu

Astra je ostvarila savršeni rezultat na testu ExploitBench. Ovaj test procjenjuje sposobnost velikih jezičnih modela da iskoriste poznate ranjivosti sustava.

OpenAI-jevi inženjeri izradili su i prilagođenu verziju testa. Tijekom testiranja Astra je pronašla i iskoristila dvije dotad nepoznate zero-day ranjivosti.

Te tvrdnje zasad nije potvrdila neovisna treća strana. Zbog toga je teško potpuno procijeniti sigurnost i stvarne mogućnosti modela.

OpenAI uvodi dodatne sigurnosne mjere

OpenAI već poboljšava sustave za prepoznavanje mogućih zlouporaba. Tvrtka također želi spriječiti pokušaje zaobilaženja sigurnosnih ograničenja, poznate kao jailbreak.

Za Astru su razvijene i nove sigurnosne tehnike, ali detalji nisu objavljeni. Računi procijenjeni kao rizičniji mogli bi dobivati ograničene odgovore modela.

OpenAI planira dodatno pratiti proces zaključivanja modela. Cilj je na vrijeme prepoznati i zaustaviti potencijalno štetno ponašanje.

Još nije jasno surađuje li OpenAI s američkim vlastima na procjeni modela. Tvrtka nije objavila ni dovoljno detalja o načinu provedbe sigurnosnih provjera.

OpenAI opisuje Astru kao svoj dosad najusklađeniji model. Ipak, njezine napredne sposobnosti otvaraju ozbiljna pitanja o mogućim zlouporabama.

Astra model mogao bi donijeti velik napredak u otkrivanju sigurnosnih propusta. Njegovo objavljivanje istodobno će pokazati koliko učinkovito OpenAI može ograničiti njegove najrizičnije mogućnosti.

Izvor: Tech Crunch; prijevod i prilagodba: financa.ba
Prilikom preuzimanja obvezno navesti izravni link na članak.

Prijavite se na naš Newsletter