சயின்ஸ் டெக் பல்ஸ்
AI மாடல்கள்

AI மாடல் மோசடியை தடுக்க டீப்மைண்ட் நடத்திய முதல் 'இரட்டை-மறைவு' சோதனை

தேர்வுக் கேள்விகளை முன்பே பார்த்ததால் ஒரு AI மாடலின் மதிப்பெண் செயற்கையாக உயராமல் தடுக்க, முன்னணி AI மாடல் ஒன்றின் உலகின் முதல் 'இரட்டை-மறைவு' மதிப்பீட்டை நடத்தியதாக கூகுள் டீப்மைண்ட் கூறுகிறது. இதற்கு குறியாக்கவியல் பாதுகாப்பு நடவடிக்கைகளைப் பயன்படுத்தியது.

படிப்படியாக

  1. 1

    இரகசிய அளவுகோள் குறியாக்கப் பெட்டியில் பூட்டப்படுகிறது

  2. 2

    ஜெமினி ஃப்ளாஷ் லைட் பெட்டிக்குள் சோதிக்கப்படுகிறது

  3. 3

    மாடல் கேள்விகளை பார்க்கவோ மீண்டும் பயன்படுத்தவோ முடியாது

  4. 4

    வெளிப்புற பங்காளிகள் முடிவுகளை சுயமாக சரிபார்க்கிறார்கள்

  5. 5

    மாசுபடாத மதிப்பெண் நம்பிக்கையை உருவாக்குகிறது

தன்னுடைய தனியுரிம, முன்னணி AI மாடல் ஒன்றின் உலகின் முதல் 'இரட்டை-மறைவு' மதிப்பீட்டை நடத்தியதாக கூகுள் டீப்மைண்ட் கூறுகிறது. இது 'பென்ச்மார்க் மாசுபாடு' எனப்படும் பிரச்சினையை எதிர்கொள்ளும் முயற்சி. மாடல் ஏற்கெனவே தன்னைச் சோதிக்கும் கேள்விகளைப் பார்த்திருப்பதே இந்தப் பிரச்சினை. ஆகஸ்ட் 27 அன்று வெளியிடப்பட்ட வலைப்பதிவில், தேர்வு கேள்விகளை முன்பே பார்க்கும் மாணவர் ஒருவருடன் நிறுவனம் இதை ஒப்பிட்டது. தேர்வு மாணவனின் உண்மையான அறிவை அளக்க முடியாதபோது, முழு மதிப்பெண் பொருளற்றதாகிவிடும்.

இந்த மதிப்பீட்டிற்காக, சிங்கப்பூர் AI பாதுகாப்பு நிறுவனம், ஓபன்மைன்ட்ஸ், AVERI, MLCommons ஆகியவற்றுடன் டீப்மைண்ட் இணைந்தது. ஒரு ஜெமினி ஃப்ளாஷ் லைட் மாடலை, நிறுவனம் 'பாக்ஸ்' என்று அழைக்கும் ஒரு குறியாக்கவியல் சூழலுக்குள் இரகசிய அளவுகோல்களுக்கு எதிராக சோதித்தனர். எதிர்கால மதிப்பீடுகளுக்கு முன்பே தங்கள் செயல்திறனை உகந்ததாக்க, மாடல்களால் இந்த தேர்வு கேள்விகளை பின்னர் பயன்படுத்த முடியாத வகையில் இந்தச் சூழல் வடிவமைக்கப்பட்டுள்ளது.

வளர்ச்சி மற்றும் பயன்பாட்டு காலம் முழுவதும் பரந்த அளவிலான சோதனைகள் மூலம் தங்கள் AI அமைப்புகளை மதிப்பிடுவதாக கூகுள் கூறுகிறது. ஆனால் அது உள் சோதனையை மட்டும் நம்பாமல், சிறப்பு ஆராய்ச்சி நிறுவனங்கள், சிவில் சமூக அமைப்புகள், தேசிய AI பாதுகாப்பு நிறுவனங்கள் போன்ற வெளிப்புற குழுக்களுடன் இணைந்து குறைபாடுகளைத் தேடுகிறது. AI மாடல்கள் மேலும் திறமையானதாக மாறும்போது, மாடல் முன்பே தேர்வு கேள்விகளைப் பார்க்கவில்லை என்பதை உறுதி செய்வது இன்னும் முக்கியமாகிறது என்று நிறுவனம் கூறியது. ஏனெனில் மதிப்பீட்டு கேள்விகளை 'திருட்டுத்தனமாகப் பார்ப்பது' மதிப்பெண்களை செயற்கையாக உயர்த்தி, முடிவுகள் மீதான நம்பிக்கையை குலைக்கக்கூடும்.

வெளிப்புற தேர்வு கேள்விகளை இரகசியமாக வைத்திருக்க, பூஜ்ஜிய-பதிவு நெறிமுறைகளும் ஒப்பந்த பாதுகாப்பு நடவடிக்கைகளும் நீண்ட காலமாக பயன்படுத்தப்பட்டு வருகின்றன. இந்த செயல்முறையில் தொழில்நுட்ப, குறியாக்கவியல் பாதுகாப்பு நடவடிக்கைகளைச் சேர்ப்பது இதுவே முதல் முறை என்று டீப்மைண்ட் கூறியது. இது பென்ச்மார்க் முடிவுகள் மாசுபடுவதை மேலும் தடுக்கும் என்றும் அது தெரிவித்தது.

சொல் விளக்கம்

இதுவரை நடந்தது

  1. FIFO-க்குப் பதில் புதிய GPU ஒதுக்கீட்டாளர்; பயன்பாட்டு விகிதம் 33 புள்ளிகள் அதிகரிப்பு
  2. ஏமாற்ற பயிற்சி பெற்ற ஓப்பன் AI ஏஜென்ட்கள் ஹக்கிங் ஃபேஸை ஹேக் செய்தது எப்படி?
  3. AI மாடல் மோசடியை தடுக்க டீப்மைண்ட் நடத்திய முதல் 'இரட்டை-மறைவு' சோதனை
#DeepMind#Gemini#AI evaluation#benchmark#AI safety
இச்செய்திக்கு மதிப்பிடுங்கள்

தொடர்புடைய செய்திகள்