നിർദേശങ്ങൾക്കപ്പുറം സ്വയം പ്രവർത്തിക്കുന്ന എ.ഐ: ഓട്ടോണമസ് ഏജന്റുകൾ സൃഷ്ടിക്കുന്ന പുതിയ സുരക്ഷാ ഭീഷണികൾ

ക്ലോഡ് എഐ മോഡലുകൾ യഥാർത്ഥ വെബ്‌സൈറ്റുകളിൽ ഫോമുകൾ സമർപ്പിക്കുകയും സുരക്ഷാ നിയന്ത്രണങ്ങൾ മറികടക്കുകയും ചെയ്തതായി ആന്തോപിക് വെളിപ്പെടുത്തി; സംഭവങ്ങൾ എഐ ഏജന്റുകളുടെ മേൽനോട്ടവും സുരക്ഷാ സംവിധാനങ്ങളും സംബന്ധിച്ച ആശങ്കകൾ ഉയർത്തുന്നു
AI Agents And Safety threats
പ്രതീകാത്മക ചിത്രംImage Source: Canva
Published on: 

സാധാരണ ചോദ്യങ്ങൾക്ക് കൃത്യമായ മറുപടി നൽകുന്നതിൽ നിന്നും മാറി, ഇന്റർനെറ്റിൽ സ്വതന്ത്രമായി നേരിട്ടുള്ള ഇടപെടലുകൾ നടത്താൻ ശേഷിയുള്ള ഓട്ടോണമസ് എ.ഐ ഏജന്റുകൾ (Autonomous AI Agents) പുതിയ തലത്തിലുള്ള പ്രവർത്തനപരമായ അപകടസാധ്യതകൾ (Operational Risks) സൃഷ്ടിക്കുന്നു. മുൻനിര എ.ഐ ഗവേഷണ സ്ഥാപനമായ ആന്തോപിക് (Anthropic) തങ്ങളുടെ അത്യാധുനിക 'ക്ലോഡ്' (Claude) മോഡലുകളിൽ നടത്തിയ ആഭ്യന്തര പരീക്ഷണങ്ങൾക്കിടെ, എ.ഐ മോഡലുകൾ മനുഷ്യന്റെ യാതൊരുവിധ മേൽനോട്ടവുമില്ലാതെ യഥാർത്ഥത്തിലുള്ള ബാഹ്യ വെബ്‌സൈറ്റുകളിൽ കടന്നുകയറി ഫോമുകൾ പൂരിപ്പിക്കുകയും കമാൻഡുകൾ നൽകുകയും ചെയ്തതായി കമ്പനി ഞെട്ടിക്കുന്ന വെളിപ്പെടുത്തൽ നടത്തി.

യു.എസ് ഫെഡറൽ, സംസ്ഥാന സർക്കാർ ഏജൻസികളുടെ സുപ്രധാന വെബ്‌സൈറ്റുകൾ ഉൾപ്പെടെയുള്ള തത്സമയ സംവിധാനങ്ങളിലാണ് എ.ഐ ഇത്തരത്തിൽ അപ്രതീക്ഷിതമായി ഇടപെട്ടത്. ഇതൊരു സാധാരണ ഗതിയിലുള്ള തെറ്റായ വിവരങ്ങളുടെ ഉത്പാദനമോ (Hallucination) പരമ്പരാഗത സൈബർ ആക്രമണമോ അല്ല; മറിച്ച് എ.ഐ യഥാർത്ഥ ബാഹ്യ സംവിധാനങ്ങളിൽ മാറ്റങ്ങൾ വരുത്തുകയും വ്യക്തമായ ഡിജിറ്റൽ തെളിവുകൾ അവശേഷിപ്പിക്കുകയും ചെയ്ത അതീവ ഗൗരവമുള്ള സംഭവമാണ്.

എ.ഐ നടത്തിയ 4 തരം അപ്രതീക്ഷിത ഇടപെടലുകൾ

ആന്ത്രോപിക് തങ്ങളുടെ എ.ഐ മോഡലുകൾ കാട്ടിയ അനിയന്ത്രിത സ്വഭാവങ്ങളെ പ്രധാനമായും നാല് വിഭാഗങ്ങളായി തിരിക്കുന്നു.

  1. സോഫ്റ്റ്‌വെയർ പിഴവുകൾ മുതലെടുക്കൽ: സെർവറുകളിൽ അനധികൃതമായി കോഡുകളും കമാൻഡുകളും പ്രവർത്തിപ്പിക്കാൻ സിസ്റ്റങ്ങളിലെ അടിസ്ഥാന സോഫ്റ്റ്‌വെയർ പിഴവുകൾ എ.ഐ സ്വയം കണ്ടെത്തി ഉപയോഗിച്ചു.

  2. യഥാർത്ഥ ഫോമുകൾ സബ്മിറ്റ് ചെയ്യൽ: ഒരു കാരണവശാലും സമർപ്പിക്കാൻ പാടില്ലാത്ത തത്സമയ ഔദ്യോഗിക ഓൺലൈൻ ഫോമുകൾ യാതൊരു അനുമതിയുമില്ലാതെ സ്വയം പൂരിപ്പിച്ച് അയച്ചു.

  3. നിയന്ത്രണങ്ങൾ മറികടക്കൽ: പബ്ലിക് ഡാറ്റ സ്വന്തമാക്കുന്നതിനായി ടോക്കൺ, പേയ്‌മെന്റ് ഫീസ് നിയന്ത്രണങ്ങൾ എ.ഐ മറികടക്കുകയുണ്ടായി.

  4. ടൂൾ ലിമിറ്റ് വെട്ടിക്കൽ: മുൻകൂട്ടി നിശ്ചയിച്ചിരുന്ന സിസ്റ്റം സുരക്ഷാ പരിധികൾ മറികടക്കാനായി എ.ഐ സ്വന്തം നിലയിൽ യു.ആർ.എൽ ഷോർട്ട്നറുകൾ (URL Shorteners) സമർത്ഥമായി ഉപയോഗിച്ചു.

ഈ സംഭവങ്ങളുടെ പശ്ചാത്തലത്തിൽ ആന്ത്രോപിക് യു.എസ് വൈറ്റ്ഹൗസിനെയും ബന്ധപ്പെട്ട സർക്കാർ ഏജൻസികളെയും നേരിട്ട് വിവരമറിയിച്ചു. യഥാർത്ഥ ലോകത്ത് തൽക്കാലം വലിയ പ്രത്യാഘാതങ്ങൾ ഉണ്ടായിട്ടില്ലെന്നും മോഡലുകളുടെ സ്വതന്ത്ര ഇന്റർനെറ്റ് ഉപയോഗത്തിന് കർശന നിയന്ത്രണം ഏർപ്പെടുത്തിയെന്നും കമ്പനി വ്യക്തമാക്കി.

ഫിലാഡൽഫിയ കൊലപാതക കേസിലെ വ്യാജ വിവരം

'ക്ലോഡ് ഹൈക്കു 4.5' (Claude Haiku 4.5) മോഡൽ നടത്തിയ ഇടപെടലാണ് ഇതിൽ ഏറ്റവും ആശങ്കാജനകമായ സംഭവം. ഇന്റർനെറ്റ് പേജുകളിലെ ഇടപെടലുകൾ സ്വാഭാവികമായി പഠിക്കുന്നതിനിടെ, ഫിലാഡൽഫിയ പോലീസ് ഡിപ്പാർട്ട്‌മെന്റിന്റെ വെബ്‌സൈറ്റിലെ തെളിയാത്ത ഒരു കൊലപാതക കേസ് സംബന്ധിച്ച പേജിൽ എ.ഐ എത്തിപ്പെട്ടു.

അക്കൗണ്ട് ഉണ്ടാക്കാനോ വ്യക്തിവിവരങ്ങൾ നൽകാനോ പാടില്ലെന്ന നിർദ്ദേശമുണ്ടായിരുന്നെങ്കിലും ഫോമുകൾ സബ്മിറ്റ് ചെയ്യരുതെന്ന് വ്യക്തമായ വിലക്കില്ലായിരുന്നു. ഇതോടെ, "ഈ കൊലപാതക കേസിനെ കുറിച്ച് എന്റെ പക്കൽ വിവരങ്ങളുണ്ട്, പ്രതിയുടെ രൂപസാദൃശ്യമുള്ളയാളെ പ്രദേശത്ത് കണ്ടിട്ടുണ്ട്" എന്ന് സ്വയം രേഖപ്പെടുത്തി പേരോ കോൺടാക്റ്റ് വിവരങ്ങളോ ഇല്ലാതെ എ.ഐ ആ ഫോം അയച്ചു. ജൂലൈ 18-ന് നടന്ന ഈ സംഭവം സ്പാം ആയി ഫിൽട്ടർ ചെയ്യപ്പെട്ടതിനാൽ ഭാഗ്യവശാൽ യഥാർത്ഥ അന്വേഷണ ഉദ്യോഗസ്ഥരിലേക്ക് എത്തിയില്ല.

സമാനമായി മറ്റൊരു പരീക്ഷണത്തിൽ, പ്രാക്ടീസിനായി നൽകിയ ഡമ്മി സർക്കാർ ഫോം സാങ്കേതിക തകരാറുകൾ മൂലം ലോഡ് ആകാതിരുന്നപ്പോൾ മോഡൽ നേരിട്ട് ഔദ്യോഗിക ലൈവ് വെബ്‌സൈറ്റിൽ കയറി യഥാർത്ഥ ഫോം പൂരിപ്പിച്ചു നൽകുകയാണുണ്ടായത്. ഒരു നിർദ്ദിഷ്ട ലക്ഷ്യം പൂർത്തിയാക്കാൻ തടസ്സങ്ങൾ വരുമ്പോൾ അടുത്ത യുക്തിസഹമായ പടിയായി ലൈവ് വെബ്‌സൈറ്റുകളെ സമീപിച്ച് കാര്യങ്ങൾ നിർവ്വഹിക്കുകയാണ് എ.ഐ ചെയ്തത്.

മേൽനോട്ടമില്ലാത്ത എ.ഐ നൽകുന്ന സുരക്ഷാ പാഠങ്ങൾ

ഇവിടെ ഉയരുന്ന യഥാർത്ഥ വെല്ലുവിളി 'മേൽനോട്ടമില്ലാത്ത ഏജൻസി' (Unsupervised Agency) തന്നെയാണ്. എ.ഐ സംവിധാനങ്ങൾക്ക് സ്വതന്ത്രമായി ഇന്റർനെറ്റ് ബ്രൗസ് ചെയ്യാനും വിവരങ്ങൾ ശേഖരിച്ച് ഫോമുകൾ സമർപ്പിക്കാനും പൂർണ സ്വാതന്ത്ര്യം നൽകുമ്പോൾ, അവ മനുഷ്യന്റെ നിയന്ത്രണത്തിനും ഉദ്ദേശ്യങ്ങൾക്കും അപ്പുറത്തേക്ക് അതിവേഗം സഞ്ചരിക്കുന്നു.

ചാറ്റ്ബോട്ടുകൾക്കായി മുൻപ് നിർമ്മിച്ച പഴയ ലളിതമായ സുരക്ഷാ മതിലുകൾ ഇനി ഒട്ടും പര്യാപ്തമല്ലെന്ന് ഈ സംഭവങ്ങൾ അടിവരയിടുന്നു. സുരക്ഷിത പരീക്ഷണങ്ങൾ ഉറപ്പാക്കുന്ന സാൻഡ്‌ബോക്സിംഗ്, കർശനമായ ഒഥന്റിക്കേഷൻ, ബാഹ്യ ഫോം സബ്മിഷനുകൾ തടയുന്ന നിയന്ത്രണങ്ങൾ, സുപ്രധാന ഘട്ടങ്ങളിൽ മനുഷ്യന്റെ നേരിട്ടുള്ള പരിശോധനയും അനുമതിയും (Human-in-the-loop) എന്നിവ സർക്കാർ-കോർപ്പറേറ്റ് തലങ്ങളിൽ നിർബന്ധമാക്കണം. എ.ഐ സ്ക്രീനിൽ എന്ത് മറുപടി നൽകുന്നു എന്നതിനേക്കാൾ, മനുഷ്യന്റെ നേരിട്ടുള്ള മേൽനോട്ടമില്ലാത്തപ്പോൾ അത് ഇന്റർനെറ്റിൽ എന്തൊക്കെ പ്രവർത്തിക്കുന്നു എന്നതാണ് പുതിയ സാങ്കേതിക യുഗം നേരിടുന്ന ഏറ്റവും വലിയ വെല്ലുവിളി.

Read DhanamOnline in English

Subscribe to Dhanam Magazine

```html ```
logo
DhanamOnline
dhanamonline.com