Appearance
داستان آشنایی من با کگل
مدتی بود که به علت روی کار اومدن ترند هوش مصنوعی خیلی زیاد اخبار مربوط به هوش مصنوعی رو دنبال میکردم ولی چیزی که بود این هست که تصمیم گرفتم واقعا به سمتش برم. در ابتدا سعی کردم چند مدل زبانی رو فاین تیون کنم.تونستم با سخت افزار رایگان گوگل کولب یک مدل qwen نیم میلیارد پارامتری رو فاین تیون کنم روی چند خط دیتا!! بعدش روی سرور های ابرفردوسی یک مدل که فکر می کنم همون مدل qwen نیم میلیارد پارامتری باشه رو ، روی اشعار فردوسی فاین تیون کردم و نتیجه فاجعه بار شد !!!(حقیقتا ورژن مدل رو یادم نمیاد احتمالا ورژن 2.5 هست!!) متوجه شدم که باید پارامتر های مدل واقعا باید زیاد و همینطور به شدت دیتای کافی داشته باشم. مدل های نیم میلیارد پارامتری و حتی 1 میلیارد یا 3 میلیارد یا حتی 7 یا 8 میلیارد پارامتری به هیچ عنوان مدل های عجوبه ای نیستن!!! قطعا مدل های پرچمداری مثل kimi k3 با 3 تریلیون پارامتر ، بدون فاین تیون هم میتونن خیلی خوب اشعار فردوسی رو تقلید و حتی تکمیل کنن.یادمون نره اکثر مدل های زبانی ، برای زبان فارسی احترام خاصی قائل نیستن و معمولا کیفیت خروجی های فارسی از باقی زبان ها کم تر هست.دیگه خودتون برای مدل نیم میلیارد پارامتری حساب کنید !!! شاید در آینده نزدیک به سراغ یک مدل 3 میلیارد پارامتری برم برای فاین تیون اشعار فردوسی !! شاید زمان آموزش رو کمی بیشتر کنم (دفعه قبل چیزی حدود نیم ساعت طول کشید !) فکر می کنم با وقت گذاشتن بشه یک چیز قابل قبول بدست آورد به خصوص که این بار می خوام متن های ویکی پدیا فارسی و شاید اشعار شاعران دیگه رو هم بدم که مدل با زبان فارسی زیاد غریبه نباشه احتما سراغ مدل gemma برم.