
Alibaba Cloud Qwen3.8-Omni-Flash – мультимодальды ИИ-моделін таныстырды, ол мәтін, суреттер, аудиожазбалар және бейнелермен бір уақытта жұмыс істейді. Жүйенің контексттік терезесі 1 млн токенге жетеді, бұл бір сұрау аясында үлкен көлемдегі ақпаратты өңдеуге мүмкіндік береді. Негізгі нұсқасы мәтіндік жауапты қалыптастырады, ал модель сыртқы функцияларды шақыруды, веб-іздеуді және реттелетін тереңдікпен ойлау режимін қолдайды. Дамытушылар Qwen3.8-Omni-Flash-ты мультимедиялық деректерді тану және талдау құралы ретінде ғана емес, сонымен қатар ИИ-агенттерді пайдалана отырып күрделі кезектескен тапсырмаларды орындау негізі ретінде де позициялайды. Alibaba Cloud Qwen3.8-Omni-Flash-Realtime нұсқасын да таныстырды, ол аудио және бейнемен нақты уақыт режимінде жұмыс істеуге арналған.
Модельдің негізгі қолдану бағыттарының бірі ретінде Alibaba ұзақ аудио және бейнежазбаларды өңдеуді атайды. Qwen3.8-Omni-Flash көпсағаттық материалдарды талдап, қажетті эпизодтарды тауып, құрылымдалған нәтижелерді қалыптастыра алады. Жазбалармен жұмыс істегенде жүйе стенограммалар жасай алады, әңгімелесушілерді ажырата алады, қойылған міндеттерді бөліп, қорытынды резюме дайындай алады. Бейне үшін пайдаланушы алдын ала уақыт аралығын, іздеу нысанын, қажетті детальдау дәрежесін және қорытынды жауаптың форматын белгілей алады. Мұндай тәсіл бір модельді мультимедиялық контенттің әртүрлі түрлері үшін пайдалануға мүмкіндік береді, бастапқы деректерді мәтінге жеке айналдыру қажеттілігінсіз. Қосымша құралдар жүйенің аударма, бейнемонтаж, түсініктеме жасау және басқа медиаматериалдарды өңдеу сценарийлеріндегі мүмкіндіктерін кеңейтеді.
Alibaba Cloud мәліметтері бойынша, Qwen3.8-Omni-Flash Qwen3.5-Omni-Plus моделіне қарағанда 29 ішкі және салалық тестте орта есеппен 25%-дан астам жоғары нәтиже көрсетті. Компания аудио және аудиовизуалды контентті API арқылы өңдеу құнының алдыңғы модельге қарағанда төмендегенін де мәлімдейді. Qwen3.8-Omni-Flash қазірдің өзінде Alibaba Cloud Model Studio арқылы қолжетімді және OpenAI API-мен үйлесімді Chat Completions және Responses интерфейстерін қолдайды. Осылайша, дамытушылар модельді қолданыстағы қосымшаларға қосып, оны жеке сұраулар үшін ғана емес, автоматтандырылған процестер құрамында да пайдалана алады. Жеке realtime-нұсқа бұл тәсілді аудио және бейнені талдау өзара әрекеттесу кезінде тікелей орындалуы тиіс сценарийлерге кеңейтеді.





