qwen
Qwen: Qwen3 VL 235B A22B Instruct
qwen/qwen3-vl-235b-a22b-instructQwen3-VL-235B-A22B Instruct — мультимодальная модель для работы с текстом, изображениями и видео. Она предназначена для задач, где нужно извлекать информацию из визуальных материалов и связывать её с текстовыми инструкциями: отвечать на вопросы по изображениям, разбирать документы, таблицы и диаграммы, распознавать текст на разных языках и анализировать видео с учётом временной последовательности. Модель также поддерживает диалоги с несколькими изображениями и использование инструментов. Её можно применять для автоматизации взаимодействия с графическим интерфейсом, сопоставления текста с фрагментами видео, задач пространственного понимания и работы с пользовательскими интерфейсами — например, при преобразовании эскизов в код или отладке UI. Помимо визуальных сценариев, она выполняет задачи генерации текста.
API ENDPOINTS
Поддерживаемые операции
ЦЕНЫ КАТАЛОГА
Тарификация в рублях
В каталоге указаны цены «от». Итоговая стоимость запроса отражается в истории списаний.
