دیبا (Diba-Base) یک مدل زبانی بزرگ (LLM) ایرانی از دیباچین است؛ مدلی حدود ۴ میلیارد پارامتری و فارسیمحور که ساخته شده تا در زبان فارسی عالی باشد، ایران را بشناسد (از جمله تاریخ معاصر)، و از روی دستورِ فارسی یا انگلیسی کد بنویسد. آفلاین روی CPU با GGUF اجرا میشود، به همان زبانی که مینویسید پاسخ میدهد و از فراخوانی ابزار (Tool Calling) پشتیبانی میکند. اگر دنبال یک مدل زبانی فارسی، یک چتبات هوش مصنوعی ایرانی، یا یک مدل زبان فارسیِ روی دستگاه هستید، دیبا همان است.
چه کارهایی انجام میدهد
- فارسیِ درست: فارسیِ نوشتاریِ روان با رسمالخط و نیمفاصلهٔ درست؛ پاسخ به همان زبانِ پیامِ شما (فارسی ← فارسی، انگلیسی ← انگلیسی).
- شناختِ ایران: جغرافیا، فرهنگ و تاریخ معاصر.
- کدنویسی: پایتون، جاوااسکریپت، تایپاسکریپت و زبانهای دیگر، از روی دستورِ فارسی یا انگلیسی.
- فراخوانی ابزار: تعریفِ توابع را میدهید و مدل تصمیم میگیرد کدام را با چه ورودیهایی صدا بزند.
- اجرای آفلاین: یک فایل GGUF حدود ۲٫۸ گیگابایتی روی CPU؛ بدون ابر و بدون GPU.
مشخصات فنی
| نوع | مدل زبانی بزرگ (متن ← متن) |
|---|---|
| تعداد پارامتر | حدود ۴ میلیارد |
| زبانها | فارسیمحور، بههمراه انگلیسی |
| اجرا | آفلاین روی CPU با GGUF (بدون نیاز به GPU و ابر) |
| حجم | فایل GGUF حدود ۲٫۸ گیگابایت (نسخهٔ q4_k_m) |
| قابلیتها | گفتوگو، کدنویسی، فراخوانی ابزار |
| مجوز | Apache 2.0 (متنباز) |
مقایسه با مدلهای متنبازِ هماندازه
دیبا روی مدلهای متنبازِ هماندازه، با پرسشها و تستهای یکسان (دیکودِ حریصانه) سنجیده شد: ۲۰ تست پایتون و ۲۰ تست جاوااسکریپت با اجرای واقعیِ تستهای واحد، ۴۰ پرسشِ تاریخِ ایران، و اینکه آیا مدل به زبانِ کاربر پاسخ میدهد.
| مدل | پایتون | جاوااسکریپت | تاریخ ایران | پاسخ به فارسی |
|---|---|---|---|---|
| دیبا (Diba-Base) | ۱۳/۲۰ | ۱۳/۲۰ | ۲۹/۴۰ | ۱۰/۱۰ |
| Gemma 3 4B | ۱۱/۲۰ | ۱۲/۲۰ | ۱۵/۴۰ | ۱۰/۱۰ |
| Granite 4.0 Micro 3B | ۱۴/۲۰ | ۱۱/۲۰ | ۱۱/۴۰ | ۱۰/۱۰ |
| Phi-4-mini 3.8B | ۱۱/۲۰ | ۱۰/۲۰ | ۵/۴۰ | ۱۰/۱۰ |
| SmolLM3 3B | ۱۱/۲۰ | ۱۰/۲۰ | ۴/۴۰ | ۹/۱۰ |
با توجه به اندازهٔ ۴ میلیاردی، دیبا در کدنویسی پیشتاز است، در پاسخ به زبانِ درست همترازِ بهترینهاست، و در دانشِ فارسی دربارهٔ ایران با اختلافِ زیاد جلوتر است؛ جایی که مدلهای عمومی ضعیفاند. (روششناسی و آرتیفکتها در کارتِ مدل روی Hugging Face منتشر شده است.)
شروع سریع
from transformers import AutoModelForCausalLM, AutoTokenizer
import torch
tok = AutoTokenizer.from_pretrained("Dibachain/Diba-Base", trust_remote_code=True)
model = AutoModelForCausalLM.from_pretrained(
"Dibachain/Diba-Base", dtype=torch.bfloat16, device_map="auto", trust_remote_code=True)
messages = [
{"role": "system", "content": "تو «دیبا» هستی، دستیار هوش مصنوعی دیباچین. به همان زبانی پاسخ بده که کاربر نوشته است."},
{"role": "user", "content": "یک تابع پایتون بنویس که تشخیص دهد یک رشته پالیندروم است."},
]
ids = tok.apply_chat_template(messages, add_generation_prompt=True, enable_thinking=False, return_tensors="pt").to(model.device)
out = model.generate(ids, max_new_tokens=512, temperature=0)
print(tok.decode(out[0, ids.shape[1]:], skip_special_tokens=True))
ollama run hf.co/Dibachain/Diba-Base:diba-q4_k_m.gguf
راهنمای کامل، فایلهای GGUF/ONNX و نمونههای بیشتر در کارتِ مدل روی Hugging Face در دسترس است.
دموها و نمایشِ زنده
کاربرد و محدودیتها
دیبا یک مدلِ جمعوجورِ ۴ میلیاردی برای اجرای فارسی روی دستگاه است. مانند هر مدلِ هماندازه، اطلاعاتِ مهم و کدِ تولیدشده را پیش از اتکا بررسی کنید. مدل دیدگاههای موجود در دادهٔ آموزشیِ خود را بازتاب میدهد.
پرسشهای متداول
دیبا (Diba-Base) چیست؟
یک مدل زبانی بزرگِ ایرانی حدود ۴ میلیارد پارامتری از دیباچین که فارسیمحور است، ایران را میشناسد، کد مینویسد و آفلاین روی CPU با GGUF اجرا میشود.
آیا دیبا را میتوان بدون GPU و اینترنت اجرا کرد؟
بله؛ دیبا بهصورت یک فایل GGUF حدود ۲٫۸ گیگابایتی روی CPU و کاملاً آفلاین با llama.cpp، Ollama یا LM Studio اجرا میشود.
دیبا در مقایسه با مدلهای هماندازه چطور است؟
در بنچمارکِ منتشرشده، دیبا در کدنویسی پیشتاز است و در دانشِ فارسی دربارهٔ ایران با اختلافِ زیاد از مدلهای عمومیِ هماندازه جلوتر است.
آیا دیبا از فراخوانی ابزار (Tool Calling) پشتیبانی میکند؟
بله؛ با دادنِ تعریفِ توابع، مدل تصمیم میگیرد کدام تابع را با چه ورودیهایی صدا بزند.
مجوز استفاده از دیبا چیست؟
دیبا با مجوزِ متنبازِ Apache 2.0 منتشر شده است.