Türkiye merkezli teknoloji şirketi VNGRS, tamamen Türkçe diline odaklanarak geliştirdiği Kumru LLM adlı büyük dil modelini tanıttı. Şirketin açıklamasına göre Kumru, 7,4 milyar parametreye sahip ve çok dilli modellerden türetilmeden sıfırdan eğitilen ilk Türkçe büyük dil modeli olma özelliğini taşıyor.
Vestel’in açıklamasına göre, proje Türkiye’nin kendi içinde konuşlandırılabilen, güvenli ve uyumlu bir temel model ihtiyacını karşılamak üzere geliştirildi. VNGRS ekibi, Türkçeye özgü dil yapısını dikkate alarak, tüketici sınıfı GPU’larda bile çalışabilen bir yapay zekâ sistemi inşa etti.
Kumru, yalnızca 16 GB VRAM kapasitesine sahip RTX A4000 veya RTX 3090 gibi ekran kartlarında çalışabiliyor. Modelin bu özelliği, büyük veri merkezlerine ihtiyaç duymadan yerel kullanım imkânı sunuyor. Ayrıca “zero-shot” yani sıfır atış yeteneği sayesinde, daha önce görmediği görevlerde dahi doğru tahminler üretebiliyor.
Teknik olarak Mistral-v0.3 mimarisi temel alınarak geliştirilen model, yapı itibarıyla LLaMA-3 düzeyinde bir performans sergiliyor. 8.192 jetonluk bağlam uzunluğu sayesinde yaklaşık 20 sayfalık metni tek seferde işleyebilen Kumru, uzun belgeler, raporlar ve sözleşmeler gibi dokümanları anlama ve özetleme konularında güçlü sonuçlar veriyor.
Kumru’nun açık kaynak versiyonu olan Kumru-2B modeli ise daha küçük donanımlarda çalışabiliyor. Sadece 4,8 GB bellek gerektiren bu versiyon, mobil cihazlar ve gömülü sistemlerde kullanılabilecek şekilde tasarlandı.
“Cetvel” isimli Türkçe değerlendirme setinde yapılan testlerde, Kumru serisi modeller; LLaMA-3.3 (70B), Gemma-3 (27B) ve Qwen-2 (72B) gibi uluslararası dev modelleri Türkçe odaklı görevlerde geride bıraktı.
Uzmanlara göre Kumru, Türkçenin yapısal inceliklerini doğal biçimde anlayabilmesiyle çok dilli modellerden ayrışıyor. VNGRS, önümüzdeki dönemde sağlık, finans, hukuk ve kamu gibi alanlara özel alt modeller geliştirmeyi planlıyor.
Yeni modelin, Türkiye’nin yapay zekâ alanında yerli ve milli LLM geliştirme kapasitesini güçlendirmesi bekleniyor.
