DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.
Пришлите ссылку — остальное мы выясним сами.
Мы рассмотрим, что вы прислали, и добавим в каталог, если подойдёт.
Расскажите про задачу — подберём инструменты и подскажем, с чего начать.
Поля со звёздочкой обязательны. Данные используются только для ответа.