சயின்ஸ் டெக் பல்ஸ்
AI மாடல்கள்

Granite 4.2: IBM நிறுவனத்தின் புதிய ஓப்பன்-வெயிட் ரீசனிங் ஏஐ மாடல் தொகுப்பு.

IBM நிறுவனம் Granite 4.2 எனும் ஓப்பன்-வெயிட் ஏஐ மொழி மாடல் தொகுப்பை வெளியிட்டுள்ளது. இது மூன்று அளவுகளில் கிடைக்கிறது, பதிலளிக்கும் முன் படிப்படியாகச் சிந்தித்து, வெளிப்புற கருவிகளையும் பயன்படுத்த முடியும்.

படிப்படியாக

  1. 1

    15T டோக்கன்களில் புதிதாகப் பயிற்சி.

  2. 2

    சங்கிலி-சிந்தனை தரவில் ஃபைன்-டியூனிங்.

  3. 3

    பல-கட்ட ரீஇன்ஃபோர்ஸ்மென்ட் லேர்னிங்.

  4. 4

    ஏஜென்டிக் RL கருவி பயன்பாட்டைக் கற்பிக்கிறது.

IBM நிறுவனம் Granite 4.2 எனும் புதிய “ரீசனிங்” ஏஐ மாடல் தொகுப்பை வெளியிட்டுள்ளது. ரீசனிங் மாடல் என்பது இறுதிப் பதிலைத் தரும் முன்பே படிப்படியான சிந்தனையை எழுதிக் காட்டும் ஏஐ மாடல் ஆகும். இந்தத் தொகுப்பில் மூன்று அளவுகள் உள்ளன — 3 பில்லியன், 8 பில்லியன், 30 பில்லியன் பாராமீட்டர்கள் (பயிற்சியின்போது மாடல் சரிசெய்யும் உள்ளக எண்கள்). முந்தைய Granite மாடல்கள் வழிமுறைகளைப் பின்பற்றும் உதவியாளர்களாக இருந்தன. Granite 4.2 இப்போது வெளிப்படையான ரீசனிங் திறனையும் சேர்த்துள்ளது.

ஒவ்வொரு மாடலும் ஆரம்பத்திலிருந்தே புதிதாகப் பயிற்றுவிக்கப்பட்டது — ஏற்கெனவே உள்ள மாடலிலிருந்து மாற்றியமைக்காமல் — சுமார் 15 டிரில்லியன் டோக்கன்களைப் (உரையின் சிறு பகுதிகள்) பயன்படுத்தி, ஐந்து கட்டப் பயிற்சி முறையில். இறுதிக் கட்டம் மாடலின் காண்டெக்ஸ்ட் விண்டோவை — ஒரே நேரத்தில் மாடல் கருத்தில் கொள்ளக்கூடிய உரையின் அளவு — 512K டோக்கன்கள் வரை நீட்டித்தது.

பயிற்சிக்குப் பின், IBM இந்த மாடல்களை ஃபைன்-டியூனிங் செய்தது. அதாவது, சிறிய, குறிப்பிட்ட தரவுத் தொகுப்பில் மேலும் பயிற்றுவித்தது. சங்கிலி-சிந்தனை ரீசனிங், வழிமுறை பின்பற்றுதல், கருவி பயன்பாடு ஆகியவை அடங்கிய சுமார் 7.2 மில்லியன் தரவு எடுத்துக்காட்டுகளை இதற்குப் பயன்படுத்தினர். மொத்தம் சுமார் 100 பில்லியன் டோக்கன்கள் இதில் அடங்கும். பிறகு, மாடல்கள் பல-கட்ட ரீஇன்ஃபோர்ஸ்மென்ட் லேர்னிங் (RL) — சிறந்த பதில்களுக்கு வெகுமதி அளிக்கும் பயிற்சி முறை — வழியாகச் சென்று தங்கள் ரீசனிங் திறனை மேலும் மெருகேற்றின.

8B, 30B மாடல்கள் கூடுதலாக ஏஜென்டிக் RL எனும் கட்டத்தைக் கடந்தன. இது அவற்றை ஏஜென்டுகளாகச் செயல்பட பயிற்றுவித்தது — வெளிப்புறக் கருவிகளை அழைத்தல், குறியீட்டைத் திருத்தி இயக்குதல். டெர்மினல் ஒன்றை இயக்குதல், வலையில் தேடுதல் ஆகியவை சேண்ட்பாக்ஸ் (பாதுகாக்கப்பட்ட சோதனைச்) சூழல்களுக்குள் நடந்தன. ஒவ்வொரு Granite 4.2 மாடலும் “சிந்திக்கும்” பயன்முறை, வேகமான “சிந்திக்காத” பயன்முறை, எளிய கேள்விகளுக்கு குறுகிய சிந்தனை அளவைச் செலவிடும் குறை-முயற்சி சிந்தனைப் பயன்முறை ஆகியவற்றுக்கு இடையே மாற முடியும்.

மூன்று Granite 4.2 மாடல்களும் Apache 2.0 உரிமத்தின் கீழ் ஓப்பன்-வெயிட் மாடல்களாக வெளியிடப்பட்டுள்ளன — அதாவது. பயிற்றுவிக்கப்பட்ட மாடல் கோப்புகளை யார் வேண்டுமானாலும் பதிவிறக்கம் செய்து பயன்படுத்தும் வகையில் IBM பொதுவெளியில் வெளியிட்டுள்ளது.

சொல் விளக்கம்

இதுவரை நடந்தது

  1. பாரம்பரிய கணினிகளால் தீர்க்க முடியாத பிரச்சினையை 15 நிமிடத்தில் தீர்த்த குவாண்டம் கணினி
  2. சுருக்கப்பட்ட AI மாடல் தன் முழு-அளவு மூலத்தையே மிஞ்சும் புதிய முறை
  3. Granite 4.2: IBM நிறுவனத்தின் புதிய ஓப்பன்-வெயிட் ரீசனிங் ஏஐ மாடல் தொகுப்பு.
#IBM#Granite 4.2#AI models#open-weight#reasoning AI#LLM
இச்செய்திக்கு மதிப்பிடுங்கள்

தொடர்புடைய செய்திகள்