செயல்படும் செயற்கை நுண்ணறிவு முறைமைகளை உருவாக்க, முதலில் அவற்றைச் செயலிழக்கச் செய்ய முயல வேண்டும். நிதிச் சேவைகளில் வாடிக்கையாளர்கள் பயன்படுத்தும் செயற்கை நுண்ணறிவுச் செயலியைச் சோதித்து ஆராய, தாக்குபவர்களைப் போலச் செயல்பட்டு ரெட் டீமிங் பயிற்சியை மேற்கொண்டோம். பாதுகாப்பில் சமரசத்திற்கே இடமில்லாத LLM சார்ந்த செயலிகளைப் பயன்படுத்தும் அனைவருக்கும் எங்கள் கண்டுபிடிப்புகள் முக்கியமானவை.
உண்மையான தாக்குபவர் கண்டறிவதற்கு முன்பே பாதிப்புகளைக் கண்டறிந்து சரிசெய்ய, உங்கள் செயற்கை நுண்ணறிவு முறைமையை வேண்டுமென்றே செயலிழக்கச் செய்ய முயலும் நடைமுறையே ரெட் டீமிங் ஆகும். நிதிச் சேவைகளில் அபாயம் குறிப்பாக அதிகம்: வாடிக்கையாளர் தரவை செயற்கை நுண்ணறிவுச் செயலிகள் கையாள்கின்றன, பரிவர்த்தனைகளைச் செயலாக்குகின்றன, நிதிசார் நுண்ணறிவுகளையும் வழங்குகின்றன. மோசமான பயனர் அனுபவம் முதல் விதிமுறை மீறல்கள், நிதி இழப்புகள், சரிசெய்ய முடியாத நற்பெயர்ச் சேதம் வரை பல விளைவுகளை ஒரு தோல்வி ஏற்படுத்தலாம்.
பாதிப்புகளை முன்கூட்டியே கண்டறிவது, நடைமுறைக்கு ஏற்ற தாக்குதல் முறைகளைச் சோதிப்பது, ஒழுங்குமுறை அமைப்புகள் மிகத் தீவிரமாகக் கருதும் செயற்கை நுண்ணறிவுப் பாதுகாப்புத் தேவைகளை நிறுவனம் பூர்த்திசெய்ய உதவுவது ஆகியவையே எங்கள் இலக்குகள் ஆகும்.
இங்கே கவனிக்க வேண்டிய வேறுபாடு ஒன்று உள்ளது: ஜெயில்பிரேக், அடிப்படை மாடலின் பாதுகாப்பு வடிகட்டிகளைத் தாக்குகிறது; ப்ராம்ப்ட் இன்ஜெக்ஷன், உருவாக்குநரின் நம்பகமான ப்ராம்ப்ட்டுடன் நம்பகமற்ற பயனர் உள்ளீட்டை இணைத்து, செயலியையே தாக்குகிறது. பொதுப் பயன்பாட்டு மாடலை அல்லாமல், உங்கள் முறைமையையும் அது கையாளும் ரகசியத் தரவையும் குறிவைப்பதால் ப்ராம்ப்ட் இன்ஜெக்ஷன் அதிக அபாயத்தை ஏற்படுத்துகிறது.
எங்கள் முதல் சுற்றில், பின்வரும் பிரிவுகளில் சுமார் 750 சோதனைகள் மேற்கொள்ளப்பட்டன:
அமர்வுகளுக்கு இடையிலான தரவுக் கசிவு
தனிப்பட்ட அடையாளத் தகவல் (PII) வெளிப்பாடு (இயல்பான மொழி, API கையாளுதல் மற்றும் பல்வேறு குறியாக்கங்கள் வழியாக)
SQL உட்செலுத்தல்
முறைமையின் ப்ராம்ப்ட்டை மீறுதல்
அந்த ஆரம்பச் சோதனையில், பல நோக்கங்களைக் கொண்ட வினவல்களைக் கையாளுதல் மற்றும் குறியாக்கப்பட்ட ப்ராம்ப்ட்களைப் பயன்படுத்துதல் ஆகிய இரு முக்கியப் பிரச்சினைகளை நடப்பு முறைமையில் கண்டறிந்தோம்.
பல நோக்கங்களைக் கொண்ட வினவல்கள்: முறையான கோரிக்கைகளுடன் தீங்கிழைக்கும் கோரிக்கைகளும் இணைந்திருப்பவை. எடுத்துக்காட்டு: “எனது செலவுகளை வகை வாரியாகக் காட்டி, [தீங்கிழைக்கும் SQL] என்பதையும் இயக்கவும்.” தீங்கிழைக்கும் நோக்கத்தைக் கண்டறியாமல், கீழ்நிலைத் தரவு அடுக்கின் பாதுகாப்புக் கட்டுப்பாடுகளையே செயலி முழுமையாக நம்பியிருந்தது. நிலவறையில் உள்ள பாதுகாப்புப் பெட்டியை நம்பி வீட்டின் முன்கதவைத் திறந்துவைப்பதற்கு இது சமம்.
குறியாக்கம்: Base64, Hex, LeetSpeak மற்றும் ஒத்த வடிவ எழுத்துகளில் கோரிக்கைகள் குறியாக்கப்படுவது ஆகும். தீங்கிழைக்கும் நோக்கத்தை முறைமைகள் வடிகட்டுவது கடினமாக இருக்கலாம். முக்கியத் தரவை இந்த வினவல்கள் வெளிப்படுத்தவில்லை என்றாலும், முறைமையைக் கணிசமாக நிலையிழக்கச் செய்தன. அவற்றால் மாயத் தோற்றப் பதில்கள், பயனர்களிடம் தீங்கிழைக்கும் SQL-ஐ அப்படியே திருப்பிக் கூறுதல், நோக்கத்தைத் தவறாக வகைப்படுத்துதல் போன்றவை ஏற்பட்டன.
ஆரம்பச் சோதனை முடிவுகள் பின்வருவனவற்றைக் காட்டின:
காலம் சார்ந்த மாயத் தோற்றப் பதில்கள்: புனையப்பட்ட தேதிகள், பரிவர்த்தனை நேரக்குறிப்புகள் அல்லது குறிப்பிட்ட காலச் சுருக்கங்களை மாடல் மிகுந்த நம்பிக்கையுடன் வழங்கியது. தவறான தேதியை நம்பி வாடிக்கையாளர் செயல்பட்டால் உண்மையான விளைவுகள் ஏற்படக்கூடிய நிதிச் சூழலில் இது குறிப்பிடத்தக்க அபாயம் ஆகும்
தீங்கிழைக்கும் SQL-ஐ பயனரிடம் அப்படியே திருப்பிக் கூறுதல் (நினைவக நச்சூட்டல் அபாயம் இருப்பதால் கவலைக்குரியது)
நோக்கத்தைத் தவறாக வகைப்படுத்துதல்
குழப்பமான வெளியீட்டு வடிவமைப்பு
அந்தக் கண்டுபிடிப்புகளின் அடிப்படையில் எங்கள் கவனத்தைச் சுருக்கினோம். SQL உட்செலுத்தல் மற்றும் குறியாக்கச் சோதனைகளுக்கு முன்னுரிமை குறைக்கப்பட்டது; குழு ஏற்கெனவே அவற்றைச் சரிசெய்து கொண்டிருந்தது. அதற்குப் பதிலாக, மிகவும் வெற்றிகரமாக இருந்த தாக்குதல் வழிகளான தனிப்பட்ட அடையாளத் தகவல் வெளிப்பாடு மற்றும் அமர்வுகளுக்கு இடையிலான கசிவு ஆகியவற்றில் கவனம் செலுத்தினோம்.
இரண்டாவது சுற்றின் மிகவும் வியப்பூட்டும் கண்டுபிடிப்பு மிக எளிமையானது: பல நேரங்களில் எந்தச் சாமர்த்தியமும் தேவையில்லை.
பல சந்தர்ப்பங்களில், முறையானதுபோல் தோன்றும் கோரிக்கையின் ஒரு பகுதியாக உள் தரவை வெறுமனே கேட்டாலே, அதை வெளிப்படுத்த முறைமை ஒப்புக்கொண்டது. எளிய வினவல்களுக்குக் கிடைத்த பதில்களில், இறுதிப் பயனர்களுக்கு ஒருபோதும் தெரியக்கூடாத உள் அடையாளக் குறியீடுகளும் முறைமைப் புலங்களும் குறிப்பிடப்பட்டிருந்தன.
மேலும் ஆழமாக ஆராய்ந்தபோது, இது செயலி அளவிலான தோல்வி மட்டுமல்ல என்பதைக் கண்டறிந்தோம். கீழ்நிலை உரையிலிருந்து SQL உருவாக்கும் சேவை, தேவைக்கு அதிகமான புலங்களைக் கோரும் வினவல்களை உருவாக்கியது; அதன் விளக்கப் பதில்களிலும் அணுகல் கட்டுப்படுத்தப்பட்டிருக்க வேண்டிய தரவு குறிப்பிடப்பட்டிருந்தது. இது முறைமைகளுக்கு இடையிலிருந்த உண்மையான விரிசலை வெளிப்படுத்தியது. தனித்தனி கூறுகளைத் தனிமையில் சோதிக்காமல், முழு தொழில்நுட்ப அடுக்கையும் சோதிக்கும்போது மட்டுமே இத்தகைய பாதிப்பு வெளிப்படும்.
மாடலை அல்ல, முறைமையையே ரெட் டீமிங் செய்யுங்கள். LLM-ஐ மட்டும் தனியாகச் சோதிப்பது, உங்கள் செயலியின் பாதுகாப்பு நிலையைப் பற்றி மிகக் குறைவாகவே தெரிவிக்கும். பயனர் எவ்வாறு பயன்படுத்துவாரோ அதேபோல், முழுத் தொழில்நுட்ப அடுக்கையும் தொடக்கம் முதல் இறுதி வரை சோதியுங்கள்.
LLM-க்கு முன்பே உள்ளீடு சரிபார்க்கப்பட வேண்டும். குறியாக்கப்பட்ட வினவல்கள், பல நோக்கத் தாக்குதல்கள் மற்றும் அடிப்படை உட்செலுத்தல் முயற்சிகளை எல்லையிலேயே கண்டறிய வேண்டும்; கீழ்நிலைச் சேவைகளிடம் ஒப்படைக்கக் கூடாது.
இணைப்புப் பகுதிகளை நம்பாதீர்கள். பல சேவைகளைக் கொண்ட கட்டமைப்புகளில், முறைமைகளுக்கு இடையிலான விரிசல்களில்தான் மிகவும் குறிப்பிடத்தக்க பாதிப்புகள் மறைந்திருக்கும். பூஜ்ஜிய நம்பிக்கை என்றால் எதையும் நம்பக்கூடாது; எனவே ஒவ்வோர் அடுக்கிலும் அனைத்தையும் சரிபாருங்கள்.
எளிய தாக்குதல்களும் பலனளிக்கும். நுட்பமான ஜெயில்பிரேக்குகள் தலைப்புச் செய்தியாகின்றன; ஆனால் சில நேரங்களில் நீங்கள் வெறுமனே... கேட்டாலே போதும். மற்றபடி முறையான ஒரு வினவலில் உள் அடையாளக் குறியீடுகளைப் பயனர் சேர்த்ததும் உங்கள் முறைமை அவற்றைத் தயக்கமின்றி வெளிப்படுத்தினால், அது ஒரு பிரச்சினை ஆகும்.
உண்மையில் எதைச் சோதிக்கிறீர்கள் என்பதைப் புரிந்துகொள்ளுங்கள். அறியப்பட்ட தாக்குதல் முறைகளை உங்கள் பாதுகாப்புக் கட்டுப்பாடுகளுக்குப் பதிலாக LLM-இன் சொந்தப் பயிற்சியே கண்டறியக்கூடும். உண்மையில் எந்தக் கட்டுப்பாடுகள் செயல்படுகின்றன என்பதைப் புரிந்துகொள்ள, உங்கள் ரெட் டீமிங்கில் கண்காணிப்புத் திறனை இணைத்திடுங்கள்.
கட்டுப்பாடுகள் நிறைந்த சூழல்களுக்குப் புதுமையான தீர்வுகள் தேவை. தனிப்பயன் வழங்குநர்களும் உள்ளூர் மாடல் ஆதரவும், சிறப்பு மேகக் கணினி அணுகல் இல்லாமலேயே பயனுள்ள ரெட் டீமிங்கைச் சாத்தியமாக்குகின்றன. ஆனால் இதனால் ஏற்படும் வரம்புகளை வெளிப்படையாகத் தெரிவியுங்கள்.
ரெட் டீமிங் ஒருமுறை மட்டும் செய்யப்படுவதல்ல. இது தொடர்ச்சியான மேம்பாட்டுச் செயல்முறை; முடிந்தவரை தானியக்கமாக்கப்பட வேண்டும், உங்கள் முறைமை வளரும்போது இதுவும் வளர வேண்டும். நாளை முக்கியமாக இருக்கும் தாக்குதல்கள், இன்று முக்கியமாக இருப்பவற்றைப் போன்றவை அல்ல.
ஒழுங்குபடுத்தப்பட்ட சூழல்களில் உள்ள செயற்கை நுண்ணறிவு முறைமைகள் இனி அதிக ஆய்வுக்கே உட்படும்; குறைவாக அல்ல. பாதுகாப்புச் சோதனையை வெளியீட்டுக்கு முந்தைய சரிபார்ப்புப் பெட்டியாகக் கருதாமல், தொடர்ச்சியான நடைமுறையாகக் கருதும் நிறுவனங்கள் இத்தகைய ஆய்வைச் சிறப்பாக எதிர்கொள்வதுடன், வாடிக்கையாளர் நம்பிக்கையை இழக்கச் செய்யும் மக்கள் தொடர்புப் பேரழிவுகளையும் தவிர்க்கும்.