超越极限，通义千问再升级：Qwen3-VL 系列 4B 与 8B 模型震撼开源上线

唠唠资讯2025年10月15日 14:00消息，阿里通义Qwen3-VL系列新增4B与8B模型，性能超越GPT-5 Nano，全面开源。

　　 10月15日，阿里通义正式宣布推出Qwen3-VL系列的新成员——采用Dense架构的Qwen3-VL-8B和Qwen3-VL-4B模型，并已开源上线。

　　 Qwen3-VL-4B/8B 是一种密集（Dense）视觉理解模型，其显存占用更少，同时具备 Qwen3-VL 的全部功能，每个版本都包含 Instruct 和 Thinking 两种模式。

　　 Qwen3-VL-8B在STEM、VQA、OCR、视频理解和Agent等任务的公开评测中表现出色，不仅超过了Gemini2.5FlashLite和GPT-5Nano，还能与上一代超大模型Qwen2.5-VL-72B相媲美。

　　而 4B 版本则在端侧展现更高的性价比，适合在需要 AI 视觉理解的智能终端部署。

　　值得一提的是，这两款视觉理解模型在“视觉精准”与“文本稳健”方面实现了协同提升：针对小模型普遍存在的“跷跷板”现象（提升视觉能力通常会牺牲文本性能，反之亦然），阿里通过架构创新和技术创新，使模型在保持文本理解能力的基础上，进一步提升了多模态感知与视觉理解能力，实现了在较小规模下具备更强的视觉与文本处理能力。

　　新模型现已在魔搭社区和HuggingFace平台上正式发布，同时提供了FP8版本，开源代码地址如下：

　　 https://modelscope.cn/collections/Qwen3-VL-5c7a94c8cb144b

　　 https://huggingface.co/collections/Qwen/qwen3-vl-68d2a7c1b8a8afce4ebd2dbe