03月30日,星期一 09:42
火讯财经讯,3月30日,阿里千问宣布全模态大模型Qwen3.5-Omni正式上线。该系列包含Plus、Flash、Light三种尺寸的Instruct版本,支持256k长上下文,可接收超过10小时的音频输入及超过400秒的720P(1FPS)音视频输入。模型基于海量文本、视觉数据及超过1亿小时的音视频数据完成原生多模态预训练,展现出卓越的全模态感知与生成能力。相比Qwen3-Omni,Qwen3.5-Omni多语言能力显著增强,支持113种语种和方言的语音识别,以及36种语种和方言的语音生成。