ફ્રી મશીન પર નાનું મોડેલ ટ્યુન કરો અને તે ઉદાહરણો પર ફેરફાર જણાવો જે તેણે ક્યારેય નથી જોયા.
Hugging Face ની સસ્તી ટ્યુનિંગ પૃષ્ઠ કહે છે કે આ રીતો આખા મોડેલને નહીં, પણ માત્ર એક નાનું એડેપ્ટર ટ્રેન કરે છે. તે વધારાનું ભાગ સામાન્ય રીતે LoRA હોય છે. આ કમ્પ્યુટ અને સ્ટોરેજ ખર્ચ ઘટાડે છે, અને મોટા મોડેલ્સને સામાન્ય હાર્ડવેર પર ટ્રેન કરવાની મંજૂરી આપે છે. મોડેલની પોતાની સંખ્યાઓને સ્પર્શવામાં આવતું નથી, એટલે એક મફત નોટબુક પૂરતી હોય છે. એક દસ્તાવેજિત રન, Google ની પોતાની LoRA ટ્યુટોરિયલમાંથી, 14 સપ્ટેમ્બર 2026 ના રોજ વાંચ્યું. તે Colab T4 પર LoRA રેન્ક 4 સાથે Gemma 3 1B ને ટ્યુન કરે છે. 1,000 ઉદાહરણો પર એક પાસ, બેચ સાઇઝ 1, ઇનપુટ 256 ટોકન સુધી કાપેલ. તે પાસ 923 સેકન્ડ લીધો, લગભગ 15 મિનિટ. ટ્યુટોરિયલ જવાબો પહેલા અને પછી બતાવે છે, સ્કોર નહીં, એટલે અલગ રાખેલા સ્કોર તમે ઉમેરવો.
- સસ્તી પદ્ધતિ નાનું adapter ટ્રેન કરે છે અને મોડેલને જ નહીં સ્પર્શે.
- તમારા માટે ત્રણ સેટિંગ્સ છે: LoRA રેન્ક, ટ્રેનિંગની લંબાઈ, અને ક્યારે રોકવું.
- તમે અલગ રાખેલા ઉદાહરણો પર માપો, અને તે જ માપદંડ વાપરો જે પહેલાં વાપર્યો હતો.
Taskફ્રી નોટબુક પર એક નાનું મોડેલ એક નક્કી કામ માટે ટ્યુન કરો અને સાચું રિપોર્ટ આપો.
Weak approach રાતભર ટ્રેનિંગ ચાલે છે, છેલ્લી પાસની નકલ રાખે છે, અને જણાવે છે કે ટ્રેનિંગના આંકડા સતત સુધરતા ગયા. અલગ રાખેલા ચાળીસ ઉદાહરણો પર રન પછી ક્યારેય સ્કોર ન કર્યો.
Stronger approach મફત Colab T4 પર LoRA રેન્ક 4 સાથે Gemma 3 1B લોડ કરે છે, જે ટ્યુટોરિયલની પોતાની સેટિંગ છે. ત્રણ ટૂંકા પાસ ચલાવે છે અને દરેક બાદ અલગ રાખેલા ચાળીસ ઉદાહરણો પર સ્કોર કરે છે. તે પાસ જ્યાં સ્કોર સૌથી વધુ થયો તે ચેકપોઈન્ટ રાખે છે, છેલ્લો નહીં. પૃષ્ઠ પર રેન્ક, પાસ, મિનિટ અને બંને સ્કોર લખે છે.
Why the stronger approach works કમજોર રિપોર્ટ તે ઉદાહરણો માપે છે જે મોડેલે જોયા. મજબૂત રિપોર્ટ તે ઉદાહરણો માપે છે જે તેણે ક્યારેય જોયા નથી, અને તે સેટિંગ્સ પણ જણાવે છે જેના પરથી આ સંખ્યા આવી.
Try a changed situation એક સાથીએ ટ્યુન કરેલું મોડેલ શેર કર્યું અને કહ્યું કે તે સારું ચાલે છે. તે કોઈ આંકડા મોકલતો નથી. તમે શું માંગશો?
Make something yourself એક નાનું મોડેલ ટ્યુન કરો. એજ અલગ રાખેલા ઉદાહરણોના પહેલા અને પછીના સ્કોર બતાવો, તમારી વાપરેલી સેટિંગ્સ અને આખા રનનો સમય જણાવો.