
10 月 4 日,阿里云通义千问开源 Qwen3-VL-30B-A3B 模型,包含 Instruct 与 Thinking 两个版本。官方表示,该模型体积更小、性能强劲,集 Qwen3-VL 全部能力于一身。
关键特性
- 仅需 30 亿激活参数,即可在 STEM、视觉问答、光学字符识别(OCR)、视频理解、智能体任务等多个领域媲美 GPT-5-Mini;
- 延续千问系列的开源路线,权重已在 Hugging Face 与 ModelScope 开放;
- 在保持低部署成本的同时,兼顾长上下文与复杂多模态理解。
开源生态背景
近期国产开源大模型密集“上新”:智源研究院开源具身智能模型 RoboBrain-X0、智谱开源新一代 GLM-4.6、华为苏黎世实验室开源量化技术 SINQ(显存占用削减 60%–70%)。通义千问长期累计开源模型已超 460 个,此次 Qwen3-VL 的发布进一步强化了其在多模态开源赛道的性价比优势。
影响与解读
当 30 亿激活参数即可对标闭源中端模型,意味着中小团队与个人开发者能以更低成本部署强多模态能力。开源模型的“经济性”正持续改写企业与个人的技术选型逻辑,也对中国大模型产业在全球开源版图中的话语权形成支撑。
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

评论(0)