DeepSeek представила V4-Flash: новый шаг к AI-агентам уровня Claude

Экспериментальная версия V4-Flash-Vision-Exp может обрабатывать текст и изображения в одном запросе, а результаты опубликованных тестов DeepSeek близки к Anthropic Opus 4.8

22 августа 2026, 19:24Искусственный интеллектDarth Sahara0

21 августа DeepSeek представила экспериментальную версию V4-Flash-Vision-Exp — мультимодальную модель, расширяющую функциональность линейки V4-Flash за счёт анализа изображений. Модель доступна через API и предназначена в первую очередь для ИИ-агентов, которым необходимо одновременно работать с текстовой и визуальной информацией: скриншотами, графиками, документами и интерфейсами.

По информации DeepSeek, новая модель сохраняет возможности V4-Flash в области работы с агентами, рассуждениями и общей эрудицией, но теперь может непосредственно учитывать изображения в процессе выполнения задач. В тестах, проведённых компанией, модель показала 83,9 балла в Terminal Bench 2.1, 57,7 в NL2Repo, 59,3 в DeepSWE, 63,6 в DSBench-Hard и 64,3 в Chartography. DeepSeek утверждает, что по совокупным результатам модель приблизилась к Anthropic Opus 4.8.

Источник: DeepSeek

Тем не менее, это сравнение не свидетельствует о безусловном превосходстве DeepSeek. Согласно опубликованной таблице, новая модель превзошла Opus 4.8 в трёх из 11 тестов, включая DeepSWE, Agents’ Last Exam и ZeroBench, но уступила в остальных. Разрыв особенно заметен в некоторых заданиях: например, в NL2Repo разница составила 12 баллов, а в DSBench-Hard — 8,1 балла. Также стоит отметить, что результаты являются данными, предоставленными самими разработчиками, и зависят от конфигурации тестов, используемых инструментов и настроек запуска.

Важно отметить, что нововведением стал Files API. Изображения можно передавать модели через Base64, внешнюю ссылку или загрузить один раз в API и затем обращаться к ним по ‘file_id’. DeepSeek сообщает, что Files API предоставляется бесплатно, а изображения учитываются при тарификации V4-Flash — до 384 токенов на изображение.

Одновременно компания выпустила обновление DeepSeek Harness 0.1.1 с поддержкой новой модели.

Для разработчиков ключевое изменение заключается в том, что визуальное восприятие теперь может быть встроено непосредственно в тот же агентский сценарий, где модель выполняет рассуждения и вызывает инструменты. Это открывает более практичные сценарии для работы, однако V4-Flash-Vision-Exp остаётся экспериментальной моделью, и её надёжность в конкретных задачах ещё предстоит проверить отдельно.

Источники:DeepSeekИскусственный интеллект0DeepSeekИскусственный интеллектКомпьютерное зрениеИИ-агентыМультимодальные модели19:24

Источник
Елизавета Воронцова

Журналист информационного портала vtambove.ru. Освещает городские события, общественную повестку, социальные инициативы и актуальные новости региона. В работе придерживается принципов точности, оперативности и понятной подачи информации. Особое внимание уделяет темам, которые напрямую влияют на жизнь жителей Тамбова и области.

Оцените автора
Тамбов