هوش مصنوعی

Naive-N0.5-Flash؛ مدل باز ۳۰۹ میلیاردی با کانتکست یک میلیونی

DevNA | devna.ir
۱ از ۶

یک مدل باز تازه برای کدنویسی

استارتاپ NaiveAI روز ۲۷ سپتامبر مدل Naive-N0.5-Flash را با وزن‌های باز و مجوز MIT روی Hugging Face منتشر کرد.

۲ از ۶

۳۰۹ میلیارد پارامتر، ۱۵٫۵ میلیارد فعال

این مدل ترکیب خبرگان (MoE) است و در هر توکن فقط بخش کوچکی از پارامترهایش را فعال می‌کند.

۳ از ۶

یک میلیون توکن بدون توجه کامل

به‌جای توجه کامل، ترکیبی از توجه پنجره‌ای ۱۲۸ توکنی و توجه تُنُک DeepSeek به کار رفته است؛ ۳۹ لایه در برابر ۹ لایه.

۴ از ۶

ساخته‌شده با کمک هوش مصنوعی

به گفته NaiveAI، مدل‌های هوش مصنوعی در طراحی معماری و بهینه‌سازی آموزش و استنتاج نقش داشته‌اند؛ ادعایی که هنوز مستقل سنجیده نشده است.

۵ از ۶

سخت‌افزار سنگین لازم است

وزن‌ها حدود ۳۱۵ گیگابایت‌اند و اجرای مدل به GPUهای NVIDIA با پشتیبانی FP8 نیاز دارد؛ API رسمی هم با قیمت ۰٫۱۰ دلار برای هر میلیون توکن ورودی عرضه شده است.

۶ از ۶

جزئیات فنی و بنچمارک‌ها

مشخصات کامل، ادعاهای بنچمارکی و نمونه کد بارگذاری مدل را در گزارش DevNA بخوانید.

ماجرای کامل را در DevNA بخوانید

NaiveAI مدل Naive-N0.5-Flash را با مجوز MIT منتشر کرد: ترکیب خبرگان ۳۰۹ میلیاردی برای کدنویسی، با کانتکست یک میلیون توکنی و بدون لایه توجه کامل.

خواندن مطلب کامل