阿里发布 Qwen3-Omni-Flash,支持人设自定义与实时流式输出

全文
2025 年 12 月 9 日,阿里巴巴 Qwen 团队正式发布 Qwen3-Omni-Flash 全模态大模型,在交互自然度、定制能力与多语言覆盖上实现显著提升。
核心技术突破
支持文本、图像、音视频无缝输入及实时流式输出;语音生成自然度大幅提升,缓解传统语音交互呆板、拖沓问题。
个性化定制
开放系统提示自定义权限,可按场景设定人设与回复风格,便于政企、文博、客服等行业快速落地。
多语言与综合能力
支持 119 种文本语言与 19 种语音识别语言;在逻辑推理、代码生成、多学科视觉问答等任务上表现增强。
对行业的启示
全模态流式交互与可定制人设,为越微 LLM + 视觉 + 机器人 VLA 闭环提供上游模型能力参考。