行业洞察

阿里发布 Qwen3-Omni-Flash,支持人设自定义与实时流式输出

Qwen3-Omni-Flash 全模态大模型技术示意图
全模态大模型与实时流式交互(行业洞察配图)

2025 年 12 月 9 日,阿里巴巴 Qwen 团队正式发布 Qwen3-Omni-Flash 全模态大模型,在交互自然度、定制能力与多语言覆盖上实现显著提升。

核心技术突破

支持文本、图像、音视频无缝输入及实时流式输出;语音生成自然度大幅提升,缓解传统语音交互呆板、拖沓问题。

个性化定制

开放系统提示自定义权限,可按场景设定人设与回复风格,便于政企、文博、客服等行业快速落地。

多语言与综合能力

支持 119 种文本语言与 19 种语音识别语言;在逻辑推理、代码生成、多学科视觉问答等任务上表现增强。

对行业的启示

全模态流式交互与可定制人设,为越微 LLM + 视觉 + 机器人 VLA 闭环提供上游模型能力参考。

关注越微动态,共筑具身智能生态。需要技术支持或方案洽谈?

联系我们