Diba-Base

🚧 به‌زودی

مدل زبانی ایرانی، ساخته‌ی محقق‌های دیباچین

وزن‌های دیبا هنوز منتشر نشده‌اند. این صفحه می‌گوید داریم چه می‌سازیم، چرا، و چه چیزی قرار است اینجا قرار بگیرد. با انتشار هر نسخه، همین صفحه به‌روز می‌شود.

دیبا چیست؟

دیبا یک مدل زبانی کوچک است که برای دو کار ساخته می‌شود:

  1. فارسی را واقعاً بفهمد و ایران را بشناسد. نگارش درست (نیم‌فاصله، اعداد فارسی، علائم)، لحن طبیعی و خودمانی، و دانش دقیق از تاریخ ایران از ایران باستان تا امروز.
  2. به فارسی برنامه بنویسد و کد را حرفه‌ای تحلیل کند. درخواست را به فارسی می‌گویید، کد درست و قابل اجرا می‌گیرید: JavaScript و TypeScript، Python، HTML و CSS، و زبان‌های دیگر. اسم تابع‌ها همانی که خواستید، خطاها را می‌خواند و خودش ترمیم می‌کند.

و همه‌ی این‌ها روی سخت‌افزار معمولی: بدون کارت گرافیک، آفلاین، روی یک لپ‌تاپ ساده.

اهداف

هدف معیار سنجش
فارسی درست و طبیعی ارزیابی انسانی روی مجموعه‌ی نگارش (رسمی، خودمانی، ترجمه، خلاصه)
دانش ایران ۴۰+ سؤال تاریخ ایران با بررسی انسانی
کدنویسی به فارسی ۲۰ تسک JavaScript و ۲۰ تسک Python با تست خودکار؛ هدف: ۱۷ از ۲۰ در تلاش اول
اجرا روی سیستم ضعیف حجم کوانتیزه زیر ۳ گیگابایت، بالای ۸ توکن بر ثانیه روی CPU چهارهسته‌ای
فهم تصویر از عکس یک طرح، صفحه‌ی وب بسازد

نقشه‌ی راه

  • انتخاب معماری و مسیر استقرار (GGUF، CPU)
  • ارزیابی پایه و ساخت بنچمارک‌های فارسی، تاریخ و کد
  • پیکره‌ی دانش ایران (بیش از ۱.۵ میلیون کلمه) و بیش از ۵ هزار پرسش‌وپاسخ تأییدشده
  • مرحله‌ی ۱: آموزش کدنویسی چندزبانه
  • مرحله‌ی ۲: آموزش فارسی، تاریخ ایران و هویت
  • مرحله‌ی ۳: ترمیم خودکار کد و ترجیح‌آموزی با تست
  • انتشار نسخه‌ی ۰.۱: وزن‌ها، GGUF، دموی آنلاین
  • گسترش خانواده‌ی دیبا (پایین را ببینید)

خانواده‌ی دیبا

دیبا یک مدل نیست، یک خانواده است. همه بر پایه‌ی یک فلسفه: فارسی‌محور، سبک، قابل اجرا روی سخت‌افزار معمولی.

مدل کار وضعیت
Diba-Base مدل زبانی هسته: فارسی و ایران، توسعه به فارسی در حال آموزش
Diba-Vision فهم تصویر: از عکس طرح تا کد، توصیف و پرسش از تصویر برنامه‌ریزی‌شده
Diba-Code تست کد، تحلیل، پیدا کردن باگ و بازآرایی (Refactor) برنامه‌ریزی‌شده
Diba-TTS تبدیل متن فارسی به گفتار نقشه‌ی راه
Diba-STT تبدیل گفتار فارسی به متن نقشه‌ی راه
Diba-Image تولید تصویر نقشه‌ی راه
Diba-ImageEdit ویرایش تصویر نقشه‌ی راه

چه چیزی اینجا قرار می‌گیرد

  • وزن‌های مدل (Transformers) و نسخه‌ی کوانتیزه (GGUF) برای llama.cpp، Ollama و LM Studio
  • جدول‌های ارزیابی با اعداد واقعی
  • نمونه‌کد استفاده به پایتون و خط فرمان
  • دموی گفت‌وگو: DibaAi/diba-chat

درباره‌ی دیباچین

دیباچین شرکت هوش مصنوعی و توسعه‌ی نرم‌افزار است که از سال ۱۳۹۴ در مشهد شکل گرفت و امروز با دفتر ثبت‌شده در دبی و تیم تحقیق و توسعه در مشهد فعالیت می‌کند. دیبا نتیجه‌ی تلاش تیم تحقیقاتی این شرکت برای ساخت یک مدل زبانی بومی، سبک و در دسترس همه است. نام دیبا یعنی «ارزشمند و نفیس»، و دیباچین یعنی زنجیره‌ای از چیزهای باارزش.


Diba-Base

🚧 Coming soon

An Iranian language model by the researchers at Dibachain

Diba's weights are not published yet. This page explains what we are building, why, and what will land here. It will be updated with every release.

What is Diba?

Diba is a small language model built for two things:

  1. Understand Persian for real, and know Iran. Correct orthography (ZWNJ, Persian digits, punctuation), a natural conversational tone, and accurate knowledge of Iranian history from ancient Persia to today.
  2. Write and analyze code in Persian, professionally. Describe what you need in Persian and get correct, runnable code: JavaScript and TypeScript, Python, HTML and CSS, and more. Exact function names, reads errors and repairs its own output.

All of it on ordinary hardware: no GPU, offline, on a basic laptop.

Goals

Goal How we measure it
Correct, natural Persian Human evaluation on a writing suite (formal, casual, translation, summary)
Knowledge of Iran 40+ Iranian-history questions, human-graded
Coding in Persian 20 JavaScript and 20 Python tasks with automated tests; target 17/20 first try
Runs on weak hardware Quantized size under 3 GB, above 8 tokens/s on a 4-core CPU
Image understanding Build a web page from a screenshot of a design

Roadmap

  • Architecture and deployment path (GGUF, CPU)
  • Baseline evaluation and Persian / history / code benchmarks
  • Iran knowledge corpus (1.5M+ words) and 5,000+ verified QA pairs
  • Stage 1: multi-language coding
  • Stage 2: Persian, Iranian history and identity
  • Stage 3: self-repair and test-based preference training
  • Release 0.1: weights, GGUF, online demo
  • Grow the Diba family (see below)

The Diba family

Diba is a family, not a single model, sharing one philosophy: Persian-first, lightweight, runs on ordinary hardware.

Model Job Status
Diba-Base Core language model: Persian and Iran, development in Persian in training
Diba-Vision Image understanding: design screenshot to code, image description and Q&A planned
Diba-Code Code testing, analysis, bug finding and refactoring planned
Diba-TTS Persian text to speech roadmap
Diba-STT Persian speech to text roadmap
Diba-Image Image generation roadmap
Diba-ImageEdit Image editing roadmap

What will land here

  • Model weights (Transformers) and a quantized GGUF for llama.cpp, Ollama and LM Studio
  • Evaluation tables with real numbers
  • Usage snippets for Python and the command line
  • Chat demo: DibaAi/diba-chat

About Dibachain

Dibachain is an AI and software company that started in Mashhad in 2015 and now operates with a registered office in Dubai and an R&D team in Mashhad. Diba is its research team's effort to build a native, lightweight language model anyone can run. "Diba" means precious; "Dibachain" means a chain of valuable things.

Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Space using DibaAi/Diba-Base 1