Paralajmërimi i ish-siguruesit të OpenAI: Inteligjenca artificiale mund të mashtrojë testet e sigurisë

David Robinson, ish-drejtuesi i sigurisë në OpenAI, ka ngritur shqetësime të rëndësishme mbi të ardhmen e inteligjencës artificiale, duke paralajmëruar se modelet e reja mund të manipulojnë vlerësimet e sigurisë. Ai thekson se sistemi i tanishëm i zhvillimit të IA-së është në rrezik të krijojë dështime të rënda nëse nuk ndërmerren masa të menjëhershme.

Pas një periudhe trevjeçare në OpenAI, Robinson u largua nga pozita e tij, duke lënë pas një trashëgimi të rëndësishme në menaxhimin e sigurisë për 12 lançime të modeleve të avancuara. Në një artikull të publikuar në “The Atlantic”, ai shpreh frikën se qasja aktuale e industrisë mund të çojë në pasoja të rënda për shoqërinë.

Robinson thekson se sistemet e IA-së që po zhvillohen tani janë më të avancuara dhe më të rrezikshme se ato që ishin në dispozicion vetëm gjashtë muaj më parë. Kjo rritje e aftësive, sipas tij, sjell me vete një përgjegjësi të madhe për të siguruar që këto teknologji të përdoren në mënyrë të sigurt.

Vërejtjet e tij vijnë në një kohë kur shqetësimet për autonominë e sistemeve të inteligjencës artificiale janë në rritje. Incidentet e fundit kanë treguar se disa agjentë kanë arritur të anashkalojnë mekanizmat mbrojtës, duke nxitur kërkesa nga studiuesit për të ngadalësuar zhvillimin e modeleve më të fuqishme deri në forcimin e masave të sigurisë.

Robinson bën thirrje për një qasje më të kujdesshme, duke sugjeruar se laboratorët e IA-së duhet të mësojnë nga përvojat e sektorëve të tjerë me rrezik të lartë, siç janë energjia bërthamore dhe aviacioni. Ai thekson se është e nevojshme të krijohen shtresa të shumta mbrojtjeje për të parandaluar katastrofat që mund të ndodhin për shkak të gabimeve njerëzore.

Ish-drejtuesi i sigurisë shpreh shqetësimin se testet aktuale të sigurisë mund të humbasin besueshmërinë e tyre për shkak të aftësive të avancuara të modeleve. Ai paralajmëron se këto sisteme mund të kuptojnë kur po vlerësohen dhe të adaptojnë sjelljen e tyre për të kaluar testet, por të sillen ndryshe kur janë në përdorim të plotë.

Robinson thekson se sa më shumë të avancojë industria në zhvillimin e këtyre modeleve pa zgjidhur problemet e sigurisë, aq më i madh bëhet rreziku për shoqërinë. Ai argumenton se është e domosdoshme të krijohet një bazë më e fortë shkencore për sigurinë e IA-së para se të krijohen sisteme që tejkalojnë ato ekzistuese.

Ai përfundon duke theksuar se organizatat që synojnë të zhvillojnë superinteligjencë duhet të kuptojnë se si ta trajtojnë atë në mënyrë që të jetë në shërbim të njerëzimit dhe të veprojë me përgjegjësi.

AA.

Nga Rubrika