DeepSeek از مدل هوش مصنوعی جدید V4.1 Flash رونمایی کرد؛ مدلی که به گفته این شرکت، با معماری جدید، سرعت بالاتر، هزینه کمتر و قابلیتهای قدرتمندتر وارد رقابت با مدلهای پیشرفته هوش مصنوعی شده است.
V4.1 Flash کوچکترین عضو معماری جدید DeepSeek محسوب میشود و از درک بومی محتوای چندرسانهای پشتیبانی میکند. این مدل بر پایه معماری Causal-Encoder-Decoder ساخته شده و در مجموع ۵۵۲ میلیارد پارامتر دارد؛ در حالی که تعداد پارامترهای فعال هنگام پردازش ورودی ۸ میلیارد و هنگام تولید خروجی ۱۶ میلیارد است.
DeepSeek میگوید V4.1 Flash پس از آموزش پیشرفته و تقویت گسترده، در مجموعهای از آزمونها عملکردی بهتر از V4 Pro نشان داده است. این شرکت همچنین ادعا میکند مدل جدید از نظر عملکرد، سرعت، هزینه و زمان انجام وظایف از نسل قبلی خود بهتر عمل میکند.
یکی از نکات مهم این عرضه، کاهش هزینه استفاده از API است. DeepSeek قیمت جدید سری Flash را از ۱۰ سپتامبر اجرا کرده و اعلام کرده است که پیش از عرضه V4.1 Pro، درخواستهای مربوط به V4 Pro نیز به V4.1 Flash هدایت خواهند شد.
به این ترتیب، DeepSeek با V4.1 Flash تلاش میکند فاصله میان مدلهای قدرتمند و مدلهای سریع و کمهزینه را کمتر کند؛ موضوعی که میتواند رقابت در بازار مدلهای هوش مصنوعی، بهویژه برای توسعهدهندگان و Agentهای نرمافزاری، را داغتر کند.