استارتاپ NaiveAI روز ۲۷ سپتامبر مدل Naive-N0.5-Flash را با وزنهای باز و مجوز MIT روی Hugging Face منتشر کرد.
این مدل ترکیب خبرگان (MoE) است و در هر توکن فقط بخش کوچکی از پارامترهایش را فعال میکند.
بهجای توجه کامل، ترکیبی از توجه پنجرهای ۱۲۸ توکنی و توجه تُنُک DeepSeek به کار رفته است؛ ۳۹ لایه در برابر ۹ لایه.
به گفته NaiveAI، مدلهای هوش مصنوعی در طراحی معماری و بهینهسازی آموزش و استنتاج نقش داشتهاند؛ ادعایی که هنوز مستقل سنجیده نشده است.
وزنها حدود ۳۱۵ گیگابایتاند و اجرای مدل به GPUهای NVIDIA با پشتیبانی FP8 نیاز دارد؛ API رسمی هم با قیمت ۰٫۱۰ دلار برای هر میلیون توکن ورودی عرضه شده است.
مشخصات کامل، ادعاهای بنچمارکی و نمونه کد بارگذاری مدل را در گزارش DevNA بخوانید.
NaiveAI مدل Naive-N0.5-Flash را با مجوز MIT منتشر کرد: ترکیب خبرگان ۳۰۹ میلیاردی برای کدنویسی، با کانتکست یک میلیون توکنی و بدون لایه توجه کامل.