Das türkisch-fokussierte KI-Modell, das Türkisch von Grund auf versteht — Platz 1 unter den offenen türkischen Modellen auf TurkishMMLU.
Offene türkische Modelle — Genauigkeit (%), identische Bedingungen
Die meisten KI-Modelle, die heute für Türkisch verwendet werden, wurden für Englisch entworfen und erst nachträglich an das Türkische angepasst. Den Preis dafür zahlt jeder türkische Nutzer: Das Modell versteht die agglutinierende Struktur des Türkischen nicht, zerlegt Wörter unnötig und arbeitet langsamer und teurer. Wir haben Erk auf einem starken offenen Basismodell aufgebaut — über eine türkische Trainingspipeline, die wir von Grund auf entwickelt haben, mit einem Ziel: das Modell, das Türkisch am besten versteht.
Platz 1 unter den offenen türkischen Modellen auf TurkishMMLU (69,7 % Genauigkeit)
Effiziente Tokenisierung — halb so viele Tokens wie GPT-4 für denselben türkischen Text
Gestützt auf echte Dokumente und maßgebliche Quellen; weist falsche Prämissen zurück
Vollständig Open Source — herunterladbar, überprüfbar, erweiterbar
Erk ist ein türkisch-fokussiertes großes Sprachmodell mit 14 Milliarden Parametern, entwickelt von eCloud Yazılım Teknolojileri. Wir haben die türkische Trainingspipeline durchgängig aufgebaut — ein von Grund auf erstelltes türkisches Korpus, umfangreiches türkisches Continued Pretraining und Instruction-Tuning, gestützt auf echte Dokumente.
Im unabhängigen, öffentlichen TurkishMMLU-Benchmark belegt Erk mit 69,7 % Genauigkeit den ersten Platz unter den getesteten offenen türkischen Modellen. Seine stärksten Fächer sind Geografie, Philosophie, Religion & Ethik sowie Geschichte. Die Auswertung wurde transparent und unter identischen Bedingungen für alle verglichenen Modelle berichtet.
Erk ist Open Source und auf Hugging Face öffentlich verfügbar. Das vollständige Trainingsrezept ist im nanosohbet-Repository offen. Die Arbeit am größeren Erk-32B läuft.
Erk ist Open Source und auf Hugging Face herunterladbar. Kontaktieren Sie uns für kommerzielle Nutzung und Partnerschaften.