علیبابا مدل جدید Qwen3-Omni-Flash-2026-09-15 را معرفی کرده است؛ مدلی چندوجهی که توانایی پردازش و درک ورودیهای صوتی را بهبود میدهد و در خانواده مدلهای Qwen قرار میگیرد. این مدل برای پردازش همزمان متن و صوت طراحی شده و میتواند درک بهتری از مکالمات و محتوای صوتی ارائه دهد.
یکی از نکات مهم این مدل، توانایی درک محتوای صوتی و تبدیل آن به اطلاعات قابل استفاده برای مدل زبانی است. Qwen تلاش کرده در نسخه جدید، عملکرد مدل را در مکالمات طبیعی، تشخیص گفتار و درک محتوای صوتی بهبود دهد.
مدل جدید همچنین برای کاربردهایی مانند دستیارهای صوتی، تحلیل فایلهای صوتی، مکالمه انسان و هوش مصنوعی و پردازش محتوای چندرسانهای قابل استفاده است. این قابلیتها میتوانند زمینه استفاده گستردهتر از مدلهای Qwen را در ابزارهای مبتنی بر صوت فراهم کنند.
Qwen در سالهای اخیر با انتشار مدلهای متنباز و چندوجهی، به یکی از پروژههای مطرح چین در حوزه هوش مصنوعی تبدیل شده است. مدلهای این خانواده در کنار متن، تصویر، صدا و سایر دادهها را نیز در سناریوهای مختلف پردازش میکنند.
انتشار مدل جدید نشان میدهد رقابت در حوزه هوش مصنوعی صوتی همچنان در حال گسترش است و شرکتهایی مانند علیبابا تلاش میکنند قابلیتهای گفتوگویی و چندوجهی را به مدلهای خود اضافه کنند.