نموذج الذكاء الاصطناعي المُركّز على التركية الذي يفهم اللغة التركية من جذورها — الأول بين النماذج التركية المفتوحة على TurkishMMLU.
النماذج التركية المفتوحة — الدقة (٪)، بظروف متطابقة
معظم نماذج الذكاء الاصطناعي المستخدمة للتركية اليوم صُمّمت للإنجليزية ثم كُيّفت للتركية لاحقًا. ويدفع كل مستخدم تركي ثمن ذلك: فالنموذج لا يفهم البنية الإلصاقية للتركية، ويُجزّئ الكلمات بإفراط، ويعمل بشكل أبطأ وأكثر تكلفة. لقد بنينا Erk على نموذج أساس مفتوح المصدر وقوي (Qwen3-14B) مع مسار تدريب تركي شامل فوقه — تدريب مُسبق مُستمر وضبط تعليمات — بهدف واحد: النموذج الأفضل في فهم اللغة التركية.
الأول بين النماذج التركية المفتوحة على TurkishMMLU (دقة 69.7٪)
ترميز فعّال — نصف عدد الرموز مقارنة بـ GPT-4 لنفس النص التركي
مبني على وثائق حقيقية ومصادر موثوقة؛ يرفض المقدّمات الخاطئة
مفتوح المصدر بالكامل — قابل للتنزيل والفحص والتطوير
Erk نموذج لغوي كبير مُركّز على التركية بحجم 14 مليار مُعامِل، طوّرته eCloud Yazılım Teknolojileri. وهو مبني على Qwen3-14B مفتوح المصدر، مع مسار تطوير تركي فوقه — تدريب مُسبق مُستمر تركي واسع وضبط تعليمات مبني على وثائق حقيقية.
في اختبار TurkishMMLU المستقل والعلني، يحتل Erk المرتبة الأولى بين النماذج التركية المفتوحة المُختبرة بدقة 69.7٪. وأقوى مجالاته هي الجغرافيا والفلسفة والدين والأخلاق والتاريخ. تم الإبلاغ عن التقييم بشفافية وبظروف متطابقة لجميع النماذج المُقارَنة.
Erk مفتوح المصدر ومتاح للعموم على Hugging Face. وصفة التدريب الكاملة مفتوحة في مستودع nanosohbet. والعمل جارٍ على الإصدار الأكبر Erk-32B.
Erk مفتوح المصدر وقابل للتنزيل على Hugging Face. تواصل معنا للاستخدام التجاري والشراكات.