Модель image-text-to-text · лицензия apache-2.0
Продолжая эпопею с Qwen 3.5 Появился набор моделей с квантизацией GPTQ-Int4 GPTQ агрессивнее в потерях точности чем FP8, но зато 35B-A3B влезет гигов в 20 GPU. Почему хорошо что сам Qwen выложили этот квант, и чем это отличается от того как сжимают его сторонние лабы? Qwen знают на чём обучали модель и могут подобрать калибровку весов максимально эффективно в отличии от сторонних лаб. Короче надо тестить пока DeepSeek v4 не вышел)
from transformers import pipeline; pipeline(model="Qwen/Qwen3.5-35B-A3B-GPTQ-Int4")
| Installs into | transformers, python |
| Type | Model |
| Section | Models & platforms / image-text-to-text |
| Pricing | open source |
| Platform | Web only |
| Hosting | cloud |
| Install | package |
| Installs into | transformers, python |
| Site language | en |
| Vendor | Qwen |
| Views | 405 758 |
| Launched | 2026-03-03 |