هوش مصنوعی جدید علی‌بابا

هوش مصنوعی Qwen حالا صدا را هم می‌فهمد؛ مدل جدید Audio 3.1 از راه رسید

گیزمکس
نویسنده: فوائد مبینی
چهارشنبه 01 مهر 1405
مدل هوش مصنوعی Qwen Audio 3.1 علی‌بابا برای پردازش صدا
Qwen Audio 3.1؛ مدل هوش مصنوعی صوتی علی‌بابا

علی‌بابا مدل جدید Qwen3-Omni-Flash-2026-09-15 را معرفی کرده است؛ مدلی چندوجهی که توانایی پردازش و درک ورودی‌های صوتی را بهبود می‌دهد و در خانواده مدل‌های Qwen قرار می‌گیرد. این مدل برای پردازش هم‌زمان متن و صوت طراحی شده و می‌تواند درک بهتری از مکالمات و محتوای صوتی ارائه دهد.

یکی از نکات مهم این مدل، توانایی درک محتوای صوتی و تبدیل آن به اطلاعات قابل استفاده برای مدل زبانی است. Qwen تلاش کرده در نسخه جدید، عملکرد مدل را در مکالمات طبیعی، تشخیص گفتار و درک محتوای صوتی بهبود دهد.

مدل جدید همچنین برای کاربردهایی مانند دستیارهای صوتی، تحلیل فایل‌های صوتی، مکالمه انسان و هوش مصنوعی و پردازش محتوای چندرسانه‌ای قابل استفاده است. این قابلیت‌ها می‌توانند زمینه استفاده گسترده‌تر از مدل‌های Qwen را در ابزارهای مبتنی بر صوت فراهم کنند.

تبلیغات

Qwen در سال‌های اخیر با انتشار مدل‌های متن‌باز و چندوجهی، به یکی از پروژه‌های مطرح چین در حوزه هوش مصنوعی تبدیل شده است. مدل‌های این خانواده در کنار متن، تصویر، صدا و سایر داده‌ها را نیز در سناریوهای مختلف پردازش می‌کنند.

انتشار مدل جدید نشان می‌دهد رقابت در حوزه هوش مصنوعی صوتی همچنان در حال گسترش است و شرکت‌هایی مانند علی‌بابا تلاش می‌کنند قابلیت‌های گفت‌وگویی و چندوجهی را به مدل‌های خود اضافه کنند.

نظرات کاربرانکپی متنکپی لینک