फ्री मशीन ते छोटा मॉडल ट्यून करो ते ओह उदाहरणां ते बदलाव बताओ जड़े ओह कदे वी नहीं देखे।
Hugging Face दी सस्ती tuning बारे पेज एहे दसदा ऐ कि ए तरीके पूरे मॉडल नूं नहीं, सिरफ इक छोटा adapter नूं ट्रेन करदे ने। ओह वध हिस्सा आमतौर ते LoRA हुंदा ऐ। ए नाल कंप्यूट ते स्टोरेज दी लागत कटदी ऐ, ते वड्डे मॉडल साधारण हार्डवेयर ते ट्रेन हो सकदे ने। मॉडल दे अपने नंबर छेड़े नहीं जांदे, इस कारण इक मुफ्त नोटबुक ही काफी ऐ। इक दर्ज रन, Google दी अपनी LoRA ट्यूटोरियल तो, 14 सितंबर 2026 नूं पढ़या गया। ए Colab T4 ते LoRA रैंक 4 नाल Gemma 3 1B नूं ट्यून करदा ऐ। 1,000 उदाहरणां ते इक पास, बैच साइज 1, इनपुट 256 टोकन तक कटे। ओह पास 923 सेकंड लगया, करीब 15 मिनट। ट्यूटोरियल जवाब पहले ते बाद दिखांदा ऐ, स्कोर नहीं, इसलई रखे गए स्कोर तुहाडा जोड़न वास्ते ऐ।
- सस्ता तरीका इक छोटा adapter ट्रेन करदा ऐ अते मॉडल नूं खुद छेड़दा नहीं।
- तिहां सेटिंग तुहाडे ने: LoRA rank, ट्रेनिंग दी लंबाई, अते कित्थे रुकना ऐ।
- ओहे अलग रखे उदाहरणां ते नापो, ओही माप जेडा तुसी पहले इस्तेमाल कीता।
Taskफ्री नोटबुक ते इक छोटा मॉडल इक खास काम वास्ते ट्यून करो ते सचाई नाल रिपोर्ट करो।
Weak approach रात भर ट्रेनिंग चलदी ऐ, आखिरी पास दी कॉपी रखदी ऐ, अते रिपोर्ट करदा ऐ कि ट्रेनिंग नंबर लगातार घटदे रहे। अलग रखे चालीस नूं रन तो बाद कभी स्कोर नहीं किता गया।
Stronger approach मुफ्त Colab T4 ते LoRA रैंक 4 नाल Gemma 3 1B लोड करदा ऐ, ट्यूटोरियल दी अपनी सेटिंग। तीन छोटे पास चलांदा ऐ ते हर इक पास तो बाद रखे गए चालीस उदाहरणां ते स्कोर करदा ऐ। ओह उस पास दा checkpoint रखदा ऐ जिथे स्कोर सब तो वधिया होया, आखिरी नहीं। रैंक, पास, मिनट ते दुनो स्कोर पेज ते लिखदा ऐ।
Why the stronger approach works कमज़ोर रिपोर्ट ओ उदाहरणां नूं मापदी ऐ जड़े मॉडल ने देखे ने। मज़बूत रिपोर्ट ओ उदाहरणां नूं मापदी ऐ जड़े मॉडल ने कदे नहीं देखे, ते ओ सेटिंग्स वी दसदी ऐ जिणा नाल ओ नंबर मिले।
Try a changed situation इक साथी ट्यून कीता मॉडल शेयर करदा ऐ ते कहंदा ऐ कि वधिया चलदा ऐ। ओह कोई नंबर नहीं भेजदा। तुसी की मांगोगे?
Make something yourself इक छोटा मॉडल ट्यून करो। ओहे अलग रखे उदाहरणां दे पहले ते बाद दे स्कोर दिखाओ, तुहाडे इस्तेमाल कीते सेटिंग्स बताओ, ते पूरा रन किन्ना समय लईया लिखो।