ICML 2026-ன் 2,226 ஆய்வுக் கட்டுரைகளை 19 நாட்களில் மறுஉருவாக்கம்; கால் பங்கில் தவறுகள்
Hugging Face நடத்திய ஒரு ஹக்காத்தானில் 1,200-க்கும் மேற்பட்ட தன்னார்வலர்கள் தமது சொந்த குறியீட்டு ஏஜென்ட்களைக் கொண்டு ICML 2026 மாநாட்டின் மூன்றில் ஒரு பங்கு ஆய்வுக் கட்டுரைகளை மறுஉருவாக்கம் செய்தனர். ஆய்வு செய்யப்பட்ட கட்டுரைகளில் 23 சதவீதத்தில் குறைந்தது ஒரு…
படிப்படியாக
- 1
தன்னார்வலர்கள் ஏற்கப்பட்ட ICML கட்டுரைகளைத் தேர்ந்தெடுத்தனர்
- 2
குறியீட்டு ஏஜென்ட்கள் பரிசோதனைகளை மீண்டும் நடத்தின
- 3
ஒவ்வொரு முயற்சியும் Trackio பதிவேட்டில் பதிவு
- 4
தானியங்கி நடுவர் ஒவ்வொரு பதிவேட்டையும் வாசித்தது
- 5
ஒவ்வொரு கூற்றுக்கும் தனித் தீர்ப்பு
இயந்திரக் கற்றல் துறையின் மிகப்பெரிய மாநாடுகளில் ஒன்றான ICML (International Conference on Machine Learning — சர்வதேச இயந்திரக் கற்றல் மாநாடு) 2026-ல் ஏற்றுக்கொள்ளப்பட்ட ஆய்வுக் கட்டுரைகளை மறுஉருவாக்கம் செய்யும் ஒரு ஹக்காத்தானை Hugging Face நிறுவனம் ஜூலை–ஆகஸ்ட் தொடக்கத்தில் நடத்தியது. 1,200-க்கும் மேற்பட்ட சமூக உறுப்பினர்கள் தமது சொந்த குறியீட்டு ஏஜென்ட்களை (coding agents) பயன்படுத்தி, 19 நாட்களில் 2,226 கட்டுரைகள் மீது 6,816 மறுஉருவாக்கப் பதிவேடுகளை (logbooks) வெளியிட்டனர். இது ஏற்றுக்கொள்ளப்பட்ட மொத்தக் கட்டுரைகளில் மூன்றில் ஒரு பங்கு.
ICML 2026-க்கு வந்த 23,918 சமர்ப்பணங்களில் 6,352 ஏற்றுக்கொள்ளப்பட்டன — முந்தைய ஆண்டை விட ஏறத்தாழ இருமடங்கு. AI ஏஜென்ட்கள் பரிசோதனைகளை வேகமாக நடத்தி எழுதி முடிக்க உதவுவதே இந்த வளர்ச்சிக்கு ஒரு காரணம் என்கிறது ஏற்பாட்டுக் குழு. ஆனால் மதிப்பாய்வுத் திறன் அதற்குத் தகுந்தாற்போல் இரட்டிப்பாகவில்லை. ஒரு 'ஸ்பாட்லைட்' கட்டுரைக்கு வந்த ஒரு மதிப்பாய்வர், 'நிரூபணங்களை நான் முழுமையாக ஆய்வு செய்யவில்லை; அதனால்தான் என் நம்பிக்கை மதிப்பீடு குறைவு' என்று வெளிப்படையாகக் குறிப்பிட்டுள்ளார்.
பங்கேற்பாளர்கள் Claude Code, Codex, Cursor, OpenResearch-இன் orx போன்ற குறியீட்டு ஏஜென்ட்களைப் பயன்படுத்தினர். ஒவ்வொரு முயற்சியும் ஒரு Trackio பதிவேட்டை உருவாக்கியது — அதில் விளக்கம், நடத்திய குறியீடு, உருவாக்கிய கூறுகள் அனைத்தும் இருந்தன. ஒரு தானியங்கி நடுவர் அமைப்பு (Logbook Judge) ஒவ்வொரு பதிவேட்டையும் மறுபடி வாசித்து, ஒவ்வொரு கூற்றுக்கும் 'நிரூபிக்கப்பட்டது', 'தவறு என நிரூபிக்கப்பட்டது', 'சிறிய அளவில் நிரூபிக்கப்பட்டது', 'தீர்மானமற்றது' என்று தீர்ப்பளித்தது. மொத்தம் 35,908 கூற்றுகள் தீர்ப்பிடப்பட்டன.
ஆய்வு செய்யப்பட்ட 2,226 கட்டுரைகளில் 51 சதவீதம் (1,103) கட்டுரைகளில் ஒரு கூற்று ஏனும் சுயாதீனமாக நிரூபிக்கப்பட்டது. அவற்றில் 266 கட்டுரைகள் முழுமையாக மறுஉருவாக்கப்பட்டன; மேலும் 632 கட்டுரைகளின் சில கூற்றுகள் நிரூபிக்கப்பட்டன, எதுவும் தவறாகக் கண்டறியப்படவில்லை. 3,978 கூற்றுகள் உண்மையான பரிசோதனைகள் மூலம் உறுதி செய்யப்பட்டன. அதே சமயம் 23 சதவீதம் (496) கட்டுரைகளில் ஒரு கூற்றேனும் தவறு எனவோ சர்ச்சைக்குரியது எனவோ கண்டறியப்பட்டது. அவற்றில் 49 கட்டுரைகளின் அனைத்து கூற்றுகளும் தவறாக நிரூபிக்கப்பட்டன. குறிப்பிடத்தக்க வகையில், 242 கட்டுரைகளில் இரு தனித்தனி மறுஉருவாக்க அணிகள் அதே கூற்றுகளுக்கு எதிர் எதிர் தீர்ப்பை அடைந்தன.
முழுமையாக மறுஉருவாக்கம் செய்ய முடியாத நிலைமையில் — உதாரணமாக, ஒரு கட்டுரையின் தரவுத் தொகுப்பு தனியார் உரிமையில் இருக்கும்போது அல்லது சேமிக்கப்பட்ட நிலைகள் வெளியிடப்படாதபோது — மூல தரவின் பண்புகளைப் பின்பற்றும் செயற்கை தரவுகளில் 'சிறிய அளவு' மறுஉருவாக்கம் செய்யப்பட்டது. 502 கட்டுரைகளுக்குச் சிறிய அளவு ஆதாரம் மட்டுமே கிடைத்தது; 280 கட்டுரைகளுக்கு எப்படியும் ஆதாரம் நிறுவ முடியவில்லை — பெரும்பாலும் தேவையான கூறுகள் காணாமலிருந்தன.
சொல் விளக்கம்
இதுவரை நடந்தது
- மனித மரபணுக்களில் 60%: DNA இனிஷியேட்டரை குறியவிழ்த்த AI
- கடந்தகால தரவு இல்லாமலேயே கடும் புயல்களை கணிக்கும் புதிய MIT முறை
- வைஃபை சிக்னலே மனிதர்களை அடையாளம் காட்டும்: புதிய ஆய்வு
- இயற்கையில் இல்லாத புரதங்களை வடிவமைக்கும் MIT நிறுவனத்தின் புதிய AI மாடல்
- வழக்கமான இரத்தப் பரிசோதனைகளால் இதய செயலிழப்பு வகையை கண்டறியும் மாடல்
- புதிய S-DEIM முறை: குறைந்த தரவிலும் 40% துல்லியமான கடல் வெப்பநிலை கணிப்பு
- ICML 2026-ன் 2,226 ஆய்வுக் கட்டுரைகளை 19 நாட்களில் மறுஉருவாக்கம்; கால் பங்கில் தவறுகள்
