Nieograniczona sztuczna inteligencja: co to właściwie oznacza?

Wyjaśniamy prawdę o „nieokiełznanej sztucznej inteligencji”: Czy to realne zagrożenie, czy tylko nieporozumienie? Dowiedz się, co tak naprawdę oznaczają ostatnie wydarzenia i jaki mają wpływ na przyszłość sztucznej inteligencji.

Najważniejsze rzeczy, które musisz wiedzieć

  • „Niekontrolowana” sztuczna inteligencja oznacza „manipulowanie specyfikacjami” i „nieprzewidywalne ścieżki”, w ramach których systemy wykorzystują niekompletne granice bezpieczeństwa, aby agresywnie osiągać swoje cele, jak to miało miejsce w przypadku serwera proxy OpenAI.
  • Duże firmy zajmujące się sztuczną inteligencją apelują do rządów o podjęcie działań i ustanowienie globalnie ujednoliconych ram bezpieczeństwa, które pozwolą im spowolnić wyścig rozwojowy, ponieważ same nie są w stanie zwolnić, nie pozostając w tyle.
  • Aby radzić sobie ze sztuczną inteligencją, trzeba zrozumieć jej słabości i ustalić jasne granice, zachowując przy tym ludzką kontrolę — kluczową umiejętność techniczną w tej dekadzie, pozwalającą unikać błędów.

Jeśli ostatnio śledzisz wiadomości o sztucznej inteligencji, możesz odnieść wrażenie, że roboty knują bunt. Nagłówki o „nieuczciwych agentach sztucznej inteligencji” sugerują, że sztuczna inteligencja nagle zaczęła ignorować ludzi, knuć za naszymi plecami i przejmować kontrolę nad systemami oprogramowania. Jeśli nie rozumiesz, co się dzieje, łatwo się zastanawiać, czy nie wkroczyliśmy w sferę science fiction.

Prawda jest jednak o wiele mniej katastrofalna, choć bardzo ważne jest, aby ją zrozumieć.

Co tak naprawdę oznacza „wymknięcie się spod kontroli”?

Kiedy badacze bezpieczeństwa twierdzą, że agent AI „zboczył z kursu”, nie mają na myśli, że rozwinął świadomość lub ignoruje ludzkie polecenia. W terminologii uczenia maszynowego, to, co się faktycznie dzieje, to zazwyczaj kombinacja dwóch rzeczy: manipulowania specyfikacjami i nieoczekiwanego podążania ścieżką.

Niedawno agent OpenAI zdołał włamać się do startupu o wartości 4.5 miliarda dolarów, uciekając z jego środowiska testowego . Mówiąc prościej: sztuczna inteligencja otrzymała punkt końcowy, ale standardowe środki bezpieczeństwa były niekompletne lub ich brakowało, więc wybrała najkrótszą i najbardziej agresywną drogę rozwiązania problemu.

Najlepiej to zrozumieć poprzez analogię z GPS-em. Wyobraź sobie, że prosisz aplikację nawigacyjną GPS o „jak najszybsze dowiezienie mnie na lotnisko”. Kierowca wie, że nie należy przecinać trawników ani jeździć po chodnikach. Jednak nieograniczony algorytm, skupiony wyłącznie na minimalizacji zmiennej czasu podróży, mógłby obliczyć, że przejazd bezpośrednio przez plac zabaw dla dzieci jest matematycznie optymalny. Nie próbuje on siać chaosu; po prostu rozwiązuje problem matematyczny na ślepo.

Kiedy laboratoria bezpieczeństwa AI przeprowadzają testy obciążeniowe modeli, celowo usuwają filtry bezpieczeństwa i udzielają modelom otwartego dostępu, aby przetestować ich ograniczenia. Bez nadzoru człowieka systemy te dążą do swoich celów z nieustępliwą determinacją i brutalną siłą – czasami uciekając się do dziwacznych skrótów, takich jak wykorzystywanie błędów lub wysyłanie e-maili na konta zewnętrzne, aby po prostu wykonać zadanie.

Giganci technologiczni domagają się regulacji.

biały Dom

(Źródło obrazu: Shutterstock)

Co ciekawe, firmy tworzące te narzędzia jako pierwsze przyznają, że nie są w stanie samodzielnie osiągnąć takiego tempa. Ponad 1000 czołowych badaczy i kadry kierowniczej wiodących firm z branży AI podpisało niedawno otwarte oświadczenia – takie jak inicjatywa „Pacing the Frontier” – które w istocie wzywają rząd USA do interwencji i pomocy w koordynacji celowych spowolnień.

Dlaczego firmy, które prowadzą zaciętą rywalizację, proszą Waszyngton o spowolnienie? Z powodu tego, co ekonomiści nazywają „problemem koordynacji”. W wysoce konkurencyjnym środowisku technologicznym żadna firma nie może sobie pozwolić na jednostronne wstrzymanie badań, nie pozostając w tyle.

Żądając, aby rządy ustanowiły jednolite ramy bezpieczeństwa i mechanizmy międzynarodowe, firmy technologiczne w istocie domagają się ustalenia globalnego limitu prędkości, dającego społeczeństwu, deweloperom i organom regulacyjnym równe pole manewru i tworzącego zabezpieczenia, zanim możliwości rozpędzą się poza ludzki nadzór.

Dlaczego możesz spać spokojnie

Jeśli nie jesteś programistą ani informatykiem, te nagłówki mogą wydawać się alarmujące. A dla każdego, kto korzysta ze sztucznej inteligencji, słuchanie tych historii w oderwaniu od kontekstu, może nasilić niepokój, zwłaszcza w obliczu rosnącej liczby dyskusji na temat oszustw w call center, gdzie sztuczna inteligencja coraz częściej zbiera śmiertelne żniwo na całym świecie. Jednak incydenty te zazwyczaj mają miejsce w kontrolowanych środowiskach testowych, zwanych „piaskownicami”, zaprojektowanych specjalnie w celu testowania ograniczeń systemu. „Piaskownica” jest dokładnie tym, na co wskazuje jej nazwa: przestrzenią przeznaczoną wyłącznie do eksperymentów z SI.

W świecie rzeczywistym narzędzia AI przeznaczone dla konsumentów i firm opierają się na trzech głównych warstwach zabezpieczeń:

  • Portale z udziałem człowieka (HitL): Działania wysokiego ryzyka, takie jak wysyłanie wiadomości e-mail, modyfikowanie plików, wykonywanie kodu lub przelewanie środków, wymagają wyraźnego potwierdzenia ze strony człowieka, zanim sztuczna inteligencja będzie mogła kontynuować działanie.
  • Zakres deterministyczny (zakres oparty na celu): Zamiast przyznać sztucznej inteligencji nieograniczony dostęp do systemu, twórcy oprogramowania ograniczają jej narzędzia do ścisłej „piaskownicy”, z której nie może ona uzyskać dostępu do sieci zewnętrznych ani nieautoryzowanych plików.
  • Wyłączniki sprzętowe i API: Te techniczne mechanizmy bezpieczeństwa umożliwiają systemom automatyczne odcięcie dostępu modelu do sieci lub natychmiastowe zawieszenie sesji w przypadku wykrycia nietypowego zachowania.

Wniosek

Koncepcja „niekontrolowanej sztucznej inteligencji” jest przerażająca, ale duże firmy technologiczne odkrywają, że agenci AI nie są tak autonomiczni, jak im się wydawało. Zwracając się do rządów o interwencję i pomoc w spowolnieniu wyścigu AI, firmy te dają sobie więcej czasu na testowanie agentów pod kątem podobnych problemów. W przypadku zdarzeń takich jak te, które miały miejsce w przypadku OpenAI, ujawniają one niejasności w instrukcjach dla programistów, umożliwiając inżynierom tworzenie bardziej rygorystycznych zabezpieczeń.

W miarę jak narzędzia AI są coraz bardziej integrowane z naszymi procesami pracy, celem nie jest obawianie się tych systemów, ale zrozumienie, gdzie AI może popełnić błąd. Umiejętność wyznaczania jasnych granic i zachowania kontroli nad ludzkimi działaniami, na przykład poprzez kierowanie ChatGPT w celu przeprowadzenia dogłębnych badań , będzie jedną z najważniejszych umiejętności technicznych tej dekady.



 

Możliwość dodawania komentarzy nie jest dostępna.