Qwen3-VL на наших серверах: читает сканы, фотографии документов, скриншоты. Изображение не уходит наружу — это принципиально, потому что на фото обычно паспорт, договор или счёт.
Годится для «что на этом снимке» и извлечения полей из фотографии. Внешней vision-модели у неё намеренно нет в резерве: это означало бы отправку чужих сканов наружу.
Для чего
- Распознать скан договора или счёта
- Извлечь данные из фотографии документа
- Понять, что изображено на скриншоте
Чего не умеет
- Маленькое окно контекста: одна-две страницы, не длинная переписка
- Не для генерации картинок — только чтение
Имя модели в API — zubr-vision. Оно не меняется при обновлении весов: интеграцию переписывать не придётся.