Diba-Base
🚧 بهزودی
مدل زبانی ایرانی، ساختهی محققهای دیباچین
وزنهای دیبا هنوز منتشر نشدهاند. این صفحه میگوید داریم چه میسازیم، چرا، و چه چیزی قرار است اینجا قرار بگیرد. با انتشار هر نسخه، همین صفحه بهروز میشود.
دیبا چیست؟
دیبا یک مدل زبانی کوچک است که برای دو کار ساخته میشود:
- فارسی را واقعاً بفهمد و ایران را بشناسد. نگارش درست (نیمفاصله، اعداد فارسی، علائم)، لحن طبیعی و خودمانی، و دانش دقیق از تاریخ ایران از ایران باستان تا امروز.
- به فارسی برنامه بنویسد و کد را حرفهای تحلیل کند. درخواست را به فارسی میگویید، کد درست و قابل اجرا میگیرید: JavaScript و TypeScript، Python، HTML و CSS، و زبانهای دیگر. اسم تابعها همانی که خواستید، خطاها را میخواند و خودش ترمیم میکند.
و همهی اینها روی سختافزار معمولی: بدون کارت گرافیک، آفلاین، روی یک لپتاپ ساده.
اهداف
| هدف | معیار سنجش |
|---|---|
| فارسی درست و طبیعی | ارزیابی انسانی روی مجموعهی نگارش (رسمی، خودمانی، ترجمه، خلاصه) |
| دانش ایران | ۴۰+ سؤال تاریخ ایران با بررسی انسانی |
| کدنویسی به فارسی | ۲۰ تسک JavaScript و ۲۰ تسک Python با تست خودکار؛ هدف: ۱۷ از ۲۰ در تلاش اول |
| اجرا روی سیستم ضعیف | حجم کوانتیزه زیر ۳ گیگابایت، بالای ۸ توکن بر ثانیه روی CPU چهارهستهای |
| فهم تصویر | از عکس یک طرح، صفحهی وب بسازد |
نقشهی راه
- انتخاب معماری و مسیر استقرار (GGUF، CPU)
- ارزیابی پایه و ساخت بنچمارکهای فارسی، تاریخ و کد
- پیکرهی دانش ایران (بیش از ۱.۵ میلیون کلمه) و بیش از ۵ هزار پرسشوپاسخ تأییدشده
- مرحلهی ۱: آموزش کدنویسی چندزبانه
- مرحلهی ۲: آموزش فارسی، تاریخ ایران و هویت
- مرحلهی ۳: ترمیم خودکار کد و ترجیحآموزی با تست
- انتشار نسخهی ۰.۱: وزنها، GGUF، دموی آنلاین
- گسترش خانوادهی دیبا (پایین را ببینید)
خانوادهی دیبا
دیبا یک مدل نیست، یک خانواده است. همه بر پایهی یک فلسفه: فارسیمحور، سبک، قابل اجرا روی سختافزار معمولی.
| مدل | کار | وضعیت |
|---|---|---|
| Diba-Base | مدل زبانی هسته: فارسی و ایران، توسعه به فارسی | در حال آموزش |
| Diba-Vision | فهم تصویر: از عکس طرح تا کد، توصیف و پرسش از تصویر | برنامهریزیشده |
| Diba-Code | تست کد، تحلیل، پیدا کردن باگ و بازآرایی (Refactor) | برنامهریزیشده |
| Diba-TTS | تبدیل متن فارسی به گفتار | نقشهی راه |
| Diba-STT | تبدیل گفتار فارسی به متن | نقشهی راه |
| Diba-Image | تولید تصویر | نقشهی راه |
| Diba-ImageEdit | ویرایش تصویر | نقشهی راه |
چه چیزی اینجا قرار میگیرد
- وزنهای مدل (Transformers) و نسخهی کوانتیزه (GGUF) برای llama.cpp، Ollama و LM Studio
- جدولهای ارزیابی با اعداد واقعی
- نمونهکد استفاده به پایتون و خط فرمان
- دموی گفتوگو: DibaAi/diba-chat
دربارهی دیباچین
دیباچین شرکت هوش مصنوعی و توسعهی نرمافزار است که از سال ۱۳۹۴ در مشهد شکل گرفت و امروز با دفتر ثبتشده در دبی و تیم تحقیق و توسعه در مشهد فعالیت میکند. دیبا نتیجهی تلاش تیم تحقیقاتی این شرکت برای ساخت یک مدل زبانی بومی، سبک و در دسترس همه است. نام دیبا یعنی «ارزشمند و نفیس»، و دیباچین یعنی زنجیرهای از چیزهای باارزش.
Diba-Base
🚧 Coming soon
An Iranian language model by the researchers at Dibachain
Diba's weights are not published yet. This page explains what we are building, why, and what will land here. It will be updated with every release.
What is Diba?
Diba is a small language model built for two things:
- Understand Persian for real, and know Iran. Correct orthography (ZWNJ, Persian digits, punctuation), a natural conversational tone, and accurate knowledge of Iranian history from ancient Persia to today.
- Write and analyze code in Persian, professionally. Describe what you need in Persian and get correct, runnable code: JavaScript and TypeScript, Python, HTML and CSS, and more. Exact function names, reads errors and repairs its own output.
All of it on ordinary hardware: no GPU, offline, on a basic laptop.
Goals
| Goal | How we measure it |
|---|---|
| Correct, natural Persian | Human evaluation on a writing suite (formal, casual, translation, summary) |
| Knowledge of Iran | 40+ Iranian-history questions, human-graded |
| Coding in Persian | 20 JavaScript and 20 Python tasks with automated tests; target 17/20 first try |
| Runs on weak hardware | Quantized size under 3 GB, above 8 tokens/s on a 4-core CPU |
| Image understanding | Build a web page from a screenshot of a design |
Roadmap
- Architecture and deployment path (GGUF, CPU)
- Baseline evaluation and Persian / history / code benchmarks
- Iran knowledge corpus (1.5M+ words) and 5,000+ verified QA pairs
- Stage 1: multi-language coding
- Stage 2: Persian, Iranian history and identity
- Stage 3: self-repair and test-based preference training
- Release 0.1: weights, GGUF, online demo
- Grow the Diba family (see below)
The Diba family
Diba is a family, not a single model, sharing one philosophy: Persian-first, lightweight, runs on ordinary hardware.
| Model | Job | Status |
|---|---|---|
| Diba-Base | Core language model: Persian and Iran, development in Persian | in training |
| Diba-Vision | Image understanding: design screenshot to code, image description and Q&A | planned |
| Diba-Code | Code testing, analysis, bug finding and refactoring | planned |
| Diba-TTS | Persian text to speech | roadmap |
| Diba-STT | Persian speech to text | roadmap |
| Diba-Image | Image generation | roadmap |
| Diba-ImageEdit | Image editing | roadmap |
What will land here
- Model weights (Transformers) and a quantized GGUF for llama.cpp, Ollama and LM Studio
- Evaluation tables with real numbers
- Usage snippets for Python and the command line
- Chat demo: DibaAi/diba-chat
About Dibachain
Dibachain is an AI and software company that started in Mashhad in 2015 and now operates with a registered office in Dubai and an R&D team in Mashhad. Diba is its research team's effort to build a native, lightweight language model anyone can run. "Diba" means precious; "Dibachain" means a chain of valuable things.