نموذج الذكاء الاصطناعي المُركّز على التركية الذي يفهم اللغة التركية من جذورها — الأول بين النماذج التركية المفتوحة على TurkishMMLU.
النماذج التركية المفتوحة — الدقة (٪)، بظروف متطابقة
معظم نماذج الذكاء الاصطناعي المستخدمة للتركية اليوم صُمّمت للإنجليزية ثم كُيّفت للتركية لاحقًا. ويدفع كل مستخدم تركي ثمن ذلك: فالنموذج لا يفهم البنية الإلصاقية للتركية، ويُجزّئ الكلمات بإفراط، ويعمل بشكل أبطأ وأكثر تكلفة. لقد بنينا Erk على نموذج أساس مفتوح قوي، عبر مسار تدريب تركي أنشأناه من الصفر — بهدف واحد: النموذج الأفضل في فهم اللغة التركية.
الأول بين النماذج التركية المفتوحة على TurkishMMLU (دقة 69.7٪)
ترميز فعّال — نصف عدد الرموز مقارنة بـ GPT-4 لنفس النص التركي
مبني على وثائق حقيقية ومصادر موثوقة؛ يرفض المقدّمات الخاطئة
مفتوح المصدر بالكامل — قابل للتنزيل والفحص والتطوير
Erk نموذج لغوي كبير مُركّز على التركية بحجم 14 مليار مُعامِل، طوّرته eCloud Yazılım Teknolojileri. لقد بنينا مسار التدريب التركي من البداية إلى النهاية — مُدوّنة تركية من الصفر، وتدريب مُسبق مُستمر تركي واسع، وضبط تعليمات مبني على وثائق حقيقية.
في اختبار TurkishMMLU المستقل والعلني، يحتل Erk المرتبة الأولى بين النماذج التركية المفتوحة المُختبرة بدقة 69.7٪. وأقوى مجالاته هي الجغرافيا والفلسفة والدين والأخلاق والتاريخ. تم الإبلاغ عن التقييم بشفافية وبظروف متطابقة لجميع النماذج المُقارَنة.
Erk مفتوح المصدر ومتاح للعموم على Hugging Face. وصفة التدريب الكاملة مفتوحة في مستودع nanosohbet. والعمل جارٍ على الإصدار الأكبر Erk-32B.
Erk مفتوح المصدر وقابل للتنزيل على Hugging Face. تواصل معنا للاستخدام التجاري والشراكات.