Китайская DeepSeek выпустила экспериментальную модель V4-Flash-Vision-Exp, которая получила поддержку изображений и ориентирована в том числе на работу ИИ-агентов.
По заявлению компании, по текстовым задачам, рассуждениям, знаниям и агентным сценариям новинка сохраняет уровень обычной V4-Flash. Главное отличие заключается в способности анализировать визуальную информацию.
За счет поддержки изображений заметно выросли результаты в тестах мультимодальных агентов. DeepSeek утверждает, что в некоторых сценариях V4-Flash-Vision-Exp приближается к уровню Claude Opus 4.8.

Модель может использовать изображение как часть контекста, анализировать увиденное и затем задействовать внешние инструменты для выполнения задачи. Поддерживается работа с различными агентными фреймворками.
Одновременно DeepSeek выпустила Harness 0.1.1 с поддержкой новой модели. V4-Flash-Vision-Exp уже появилась на API-платформе компании, причем стоимость использования оставили на уровне V4-Flash.
Пока модель имеет статус экспериментальной, поэтому ее возможности и характеристики в дальнейшем могут измениться.





































