--- license: apache-2.0 language: [sr, hr, bs, mk, sl, sq, cnr, bg, el, tr, ro, hu] base_model: Qwen/Qwen3-8B library_name: transformers tags: [balkan, southeast-europe, multilingual, honest-ai, sovasoft] --- 🌐 [EN](README.md) · [SR](README_sr.md) · [HR](README_hr.md) · [BS](README_bs.md) · [MK](README_mk.md) · [SL](README_sl.md) · [SQ](README_sq.md) · [CNR](README_cnr.md) · [BG](README_bg.md) · [EL](README_el.md) · [TR](README_tr.md) · [RO](README_ro.md) · [HU](README_hu.md)

Zora — Göttin der Morgenröte, umgeben von den Symbolen der 12 Völker

# Zora v1.11 — Balkan ve Güneydoğu Avrupa için açık, dürüst bir LLM *зора = „şafak". Hepsini birleştiren tek bir model.* — **Sovasoft** ([ai.in.rs](https://ai.in.rs)) tarafından --- ## 1 · Zora nedir? Zora; Sırpça, Hırvatça, Boşnakça, Makedonca, Slovence, Arnavutça, Karadağca, Bulgarca, Yunanca, Türkçe, Romence ve Macarca olmak üzere **Balkanlar ve Güneydoğu Avrupa'nın 12 dili** için geliştirilmiş **açık bir 8B dil modelidir** (Qwen3-8B tabanlıdır). Zora en büyük model olmak için değil; **dürüst, dile hakim ve çok perspektifli** olmak için inşa edilmiştir: - İngilizce üzerinden aktarma yapmak yerine **hedef dilde düşünür**, - Tartışmalı konularda tek bir ulusal görüş yerine **birkaç farklı perspektif** sunar, - Ve her şeyden önemlisi: Gerçekleri uydurmak yerine **bilmediği zaman bunu itiraf eder**. ## 2 · Geliştirme hikayesi (v1.0 → v1.1 → v1.11) | Versiyon | Diller | Durum | |---|---|---| | **v1.0** | 6 | ilk halka açık sürüm | | **v1.1** | 12 | sıfırdan eğitildi — ancak **gerçekleri halüsinasyonla uydurdu** (kitap başlıklarını uydurdu, yanlış yazarlar belirtti). **Asla yayınlanmadı.** | | **v1.11** | 12 | dürüstlük düzeltmesi: „bilmiyorum" der, emin olmadığında arama yapar, dil içi akıl yürütme gerçekleştirir. **Bu sürüm.** | v1.1 bize temel bir ders verdi: küçük bir model her gerçeği *ezberleyemez*, bu yüzden uydurmak yerine **v1.11 dürüst olması için yeniden eğitildi** (aşağıdaki benchmark'a bakınız). ## 3 · Güçlü ve zayıf yönler (dürüstçe) **Güçlü Yönler** - ✅ **Dürüstlük:** Halüsinasyon görmek yerine belirsizliği kabul eder (v1.1'e kıyasla HALLU 1→10, DETAIL 0→8) - ✅ **Dil içi kalite:** öğretim, uzun formlu içerikler, talimatlar — 12 dilin tamamında güçlüdür - ✅ **Araç ayrımı:** genel bilgi sorularını doğrudan yanıtlar, yalnızca gerektiğinde arama yapar - ✅ Tartışmalı tarih/kültür konularında **çok perspektifli** yaklaşım **Sınırlar (dikkat edilmesi gerekenler)** - ⚠️ **Çok adımlı mantık/matematik** (LOGIC/ANALYSIS) zayıftır — bu bir 8B limitidir; adım adım `` kullanımı yardımcı olur ve v1.12'de iyileştirilmektedir - ⚠️ **Olgu derinliği sınırlıdır** (8B) — kesin gerçekler (hukuk, tarihler, güncel veriler) için **RAG/web-arama** kullanın, hafızaya güvenmeyin - ⚠️ **Kuantizasyon:** **Q5_K_M / Q6_K / Q8_0** kullanın. **Q4 ve altından kaçının** — ağır kuantizasyon testlerimizde modelin halüsinasyon görmesine neden oldu. ## 4 · Benchmark (BalkanBench, 13 eksen × 12 dil) 🔬 **BalkanBench is open** — test any model yourself: https://github.com/olivilo/balkanbench Deterministik puanlama (betik / dil / anahtar kelimeler / sayılar). v1.11 (16-bit): **84/156**. **Zora alanında liderdir** — mevcut Gemma-4-31B ve Qwen3.6-30B dahil olmak üzere kendisinden 3-4 kat daha büyük modelleri geride bırakmaktadır: ![Overall ranking](charts/rank_tr.png) | Model | Boyut | Puan | |---|---|---| | **Zora v1.11** | **8B** | **84** | | Gemma-4-31B | 31B | 77 | | Mistral-24B | 24B | 73 | | Qwen3.6-30B | 30B | 73 | | Salamandra | 7B | 66 | | EuroLLM | 9B | 65 | | Qwen2.5-32B | 32B | 65 | | Gemma-2-27B | 27B | 63 | | Aya | 8B | 61 | | BgGPT | 7B | 56 | | YugoGPT | 7B | 35 | Kuantizasyon performansı güçlü kalıyor — Q5/Q6/Q8'in tamamı kullanılabilir durumda (Q4'ten kaçının): Sayılarla dürüstlük düzeltmesi ve eksen bazlı güçlü yönler: ![Evolution v1.1 → v1.11](charts/evolution_tr.png) ![v1.11 axis matrix](charts/matrix_tr.png) ## 5 · Kullanım **Önerilen kuant:** Q5_K_M (dengeli) veya Q6_K (kayıpsıza yakın). Ollama: `ollama run olivilo/zora # or: ollama run hf.co/sovasoft/zora-v1.11:Q5_K_M`. ```python from transformers import AutoModelForCausalLM, AutoTokenizer tok = AutoTokenizer.from_pretrained("sovasoft/zora-v1.11") model = AutoModelForCausalLM.from_pretrained("sovasoft/zora-v1.11", device_map="auto") ``` 📚 **Give Zora your own knowledge:** see [RAG-GUIDE](RAG-GUIDE.md) — connect your own documents (`zora_rag.py`, Ollama+numpy) or live web search. Zora answers only from the sources and admits when it cannot find the answer. ## 6 · Zora'nın büyümesine yardımcı olun Zora'nın en zayıf olduğu alanlar olgu derinliği ve bazı daha küçük dillerdir. 12 dilden herhangi birinde **açık, lisanslanabilir kaynaklar** (metinler, korpuslar, sözlükler) gönderin → **kontakt@ai.in.rs**. Kendi dilinizde düşünmenin neden önemli olduğu hakkında çok dilli manifesto *WHY-LANGUAGES*'a göz atın. ## 7 · Teşekkürler Zora, açık kaynak sayesinde var oldu. Resmi ve yürekten teşekkürlerimizi sunarız: - **Her şeyden önce, Alibaba'daki Qwen ekibine** — Zora'nın üzerine inşa edildiği temel model olan **Qwen3**'ü (Apache-2.0) geliştirdikleri ve açık kaynak olarak sundukları için. Onların cömertliği olmasaydı Zora var olmazdı. - Bunu mümkün kılan **platformlara ve yapılara** — **Kaggle, Google Colab, Modal, HuggingFace, Ollama, Unsloth** — hesaplama gücü, araçlar ve açık altyapı için. - **Açık kaynak topluluğuna**, herkesle özgürce paylaşılan modeller, kodlar ve bilgiler için. - **Balkan halklarına** — dilleri, sesleri, hikayeleri ve perspektifleri Zora'nın ta kendisi olduğu için. - Ve **var olan her şeye**. *зора — şafak herkese aittir.* --- *Sovasoft · ai.in.rs · hepsini birleştiren tek bir model*