Türkçe'yi kökünden anlayan, TurkishMMLU'da açık Türkçe modellerin birincisi olan yapay zekâ modeli.
Açık Türkçe modeller — doğruluk (%), aynı koşullarda
Bugün Türkçe kullanan yapay zekâ modellerinin çoğu İngilizce için tasarlandı; Türkçe'ye sonradan uyarlandı. Bunun bedelini her Türkçe kullanıcı öder: model, dilimizin sondan eklemeli yapısını tanımaz, kelimeleri gereksiz parçalara böler, daha yavaş ve daha maliyetli çalışır. Erk'i, güçlü ve açık kaynaklı bir temel model (Qwen3-14B) üzerine kurduğumuz kapsamlı Türkçe eğitim hattıyla — sürekli ön-eğitim ve talimat ayarı — geliştirdik; amacımız Türkçe'yi en iyi anlayan modeli üretmekti.
TurkishMMLU'da açık Türkçe modellerin birincisi (%69,7 doğruluk)
Aynı Türkçe metni GPT-4'ün yarısı kadar token'a bölen verimli tokenizasyon
Gerçek belgeler ve otoriter kaynaklarla beslenmiş; yanlış öncülleri reddeder
Tamamen açık kaynak — indirilebilir, incelenebilir, geliştirilebilir
Erk, eCloud Yazılım Teknolojileri tarafından geliştirilen 14 milyar parametreli, Türkçe odaklı bir büyük dil modelidir. Açık kaynaklı Qwen3-14B temel alınarak, üzerine kurduğumuz Türkçe geliştirme hattıyla — kapsamlı Türkçe sürekli ön-eğitim ve gerçek belgelerle talimat ayarı — geliştirilmiştir.
Bağımsız ve kamuya açık TurkishMMLU kıyaslamasında Erk, test edilen açık Türkçe modellerin birincisidir: %69,7 doğruluk. En güçlü olduğu alanlar coğrafya, felsefe, din ve ahlak ile tarihtir. Değerlendirme, tüm rakip modellerle aynı koşullarda ve şeffaf biçimde raporlanmıştır.
Erk açık kaynaktır ve Hugging Face üzerinden herkese açıktır. Modeli doğuran eğitim reçetesinin her adımı da nanosohbet deposunda açıktır. Genişletilmiş ölçekli sürüm Erk-32B üzerindeki çalışmalar sürmektedir.
Erk açık kaynaktır ve Hugging Face üzerinden indirilebilir. Ticari kullanım ve iş birlikleri için bizimle iletişime geçebilirsiniz.