AI & ML interests
Sovereign Intelligence. Global Scale.
Recent Activity
eCloud Tech., 2010'dan bu yana yapay zekâ, siber güvenlik ve yazılım alanlarında çalışan bir teknoloji şirketidir — Şanlıurfa (merkez), Ankara, Düsseldorf. Türkçeyi kökünden anlayan modeller geliştiriyoruz ve her sayıyı ölçüldüğü koşulla, güven aralığıyla ve yeniden üretim betiğiyle yayımlıyoruz. Bir model kendi dilini düşünmeli; bir sonuç kendi belirsizliğini taşımalı.
English below.
Erk-32B
Qwen3-32B tabanı üzerine 1,05 milyar token Türkçe devam-eğitimi ve talimat ayarı. Ağırlıklar Apache-2.0 ile, safetensors ve GGUF olarak; kimlik istemi sohbet şablonunda, taban her yerde açıkça belirtilir.
| Taban Qwen3-32B | Erk-32B | Fark · %95 GA | |
|---|---|---|---|
| TurkishMMLU, temiz 652, şık döndürmeli | %67,64 | %71,01 | +3,37 [+0,61, +6,13] |
| TurkMorfBench v2 üretim (512) | %31,64 | %59,38 | +27,73 [+22,46, +33,01] |
| TurkMorfBench v2 zorunlu seçim (502) | %89,44 | %91,43 | +1,99 [−0,20, +4,18] · gösterilemedi |
| Kimlik, 30 tuzaklı soru | — | 30/30 |
Model · GGUF · Ölçüm protokolü ve betikler
Ölçüm ilkesi
Hiçbir sayı şu dört eleme uygulanmadan raporlanmaz:
| Kirlilik denetimi | TurkishMMLU'nun 900 test sorusundan 113'ü Türkçe web'de birebir geçiyor; bunlar ve eğitimde izlenen 150 soru dışarıda → temiz 652 |
| Şık döndürme | her soru şık sırası döndürülerek ölçülür; harf ve konum yanlılığı elenir |
| Zorunlu seçim vs üretim | biçim uyumu bilgiden ayrılır — üretimde +36 görünen bir fark zorunlu seçimde +3,7, düzeltilmiş kıyasta "gösterilemedi" çıktı |
| Eşli bootstrap | 10.000 yeniden örnekleme; aralığı sıfırı içeren fark "fark yok" değil, "gösterilemedi" |
Yolda düzeltilen on dört ham sayının günlüğü raporda; hiçbiri dışarıdan bildirilmedi.
Erk ailesi
| Model | Taban | TurkishMMLU, temiz 652 | Lisans | |
|---|---|---|---|---|
| Erk-32B · Eylül 2026 | Qwen3-32B | %71,01 · +3,37 [+0,61, +6,13] | Apache-2.0 | Model · GGUF |
| Erk-14B | Qwen3-14B | %67,18 · +6,60 [+3,07, +10,28] · tam küme 0-shot %69,7 | eCloud Açık Topluluk | Model |
| Erk-Linear | Erk-14B | dikkat katmanlarının lineerleştirilmesi — hibrit model, sınır analizi | Model |
Erk-14B'nin %69,7'si tam kümede, döndürmesiz 0-shot ölçümüdür; %67,18 aynı modelin temiz protokoldeki sayısıdır. Erk-14B'nin açık eğitim reçetesi: nanosohbet.
Veri kümeleri
| TurkMorfBench | Türkçe morfoloji kıyası — 512 madde, 8 ek görevi, 40 gerçek + 24 uydurma (wug) gövde. Uydurma gövde külliyatta hiç geçmez; doğru ek, ezber değil kural bilgisidir. Üretim ve zorunlu seçim kipleri; üretici motor, bağımsız kural denetimi (512/512) ve morfolojik çözümleyici çapraz kontrolü depoda. CC BY 4.0 |
| TurkishMMLU Kirlilik Listesi | 900 test sorusundan Türkçe web'de birebir geçen 113'ünün (n=13; gevşek eşikte 252) dizin ve özeti, yöntem ve betik. Türkçe web ile eğitilen her model için kirlilik dışı raporlama imkânı. CC BY 4.0 |
GitHub: erk-32b · turkmorfbench · turkishmmlu-kirlilik · erk · erk-linear · nanosohbet
Ürünler
| AIGENCY | Çok kipli, Türkçe öncelikli yapay zekâ platformu |
| Evrak AI | Bireyler, kurumlar ve avukatlar için hukuk platformu: içtihat erişimi, dilekçe ve sözleşme üretimi, dosya yönetimi |
| Doctor AI | Klinik karar destek sistemi |
| BICRM · Translator · Gazete AI | Kurumsal CRM · çoklu dil çeviri · otomatik içerik üretimi |
English
eCloud Tech. is a technology company founded in 2010 in Şanlıurfa, Türkiye (offices in Ankara and Düsseldorf), working across AI, cybersecurity and software. We build Turkish language models and publish every number with the condition it was measured under, a confidence interval and a reproduction script.
Erk-32B (September 2026, Apache-2.0) is Qwen3-32B continued-pretrained on 1.05B Turkish tokens and instruction-tuned. On contamination-free TurkishMMLU it scores 71.01% (+3.37 [+0.61, +6.13] over its base); on TurkMorfBench v2 generation 59.38% vs 31.64%; on forced choice the gain is not demonstrable and we say so. Weights in safetensors and GGUF, identity via a default system prompt, base model stated everywhere. Erk-14B scores 67.18% under the same protocol (69.7% on the full set, 0-shot); Erk-Linear is a hybrid linear-attention distillation of Erk-14B.
Nothing is reported without a contamination audit (113/900 TurkishMMLU questions found verbatim on the Turkish web — the list is public), option rotation, forced-choice measurement and paired bootstrap CIs; fourteen corrected raw numbers are logged in the report. We also publish TurkMorfBench, a Turkish morphology benchmark with nonce stems, and the TurkishMMLU contamination list, both CC BY 4.0.
![Erk-32B — TurkishMMLU temiz 652: %71,01, tabana göre +3,37 [+0,61, +6,13]](https://huggingface.co/spaces/ecloudtech/README/resolve/main/assets/erk-32b.png)