DeepSeek твърди, че новият V4 Flash Vision се доближава до Claude Opus 4.8

Китайската компания DeepSeek представи експериментален мултимодален вариант на своя водещ AI модел V4 Flash. Новото предложение се нарича DeepSeek-V4-Flash-Vision-Exp и разширява възможностите на досегашния текстов модел с обработка на визуална информация, включително изображения и екранни снимки.

Според компанията експерименталният модел запазва текстовите възможности на DeepSeek-V4-Flash в области като разсъждение, общи познания и работа с AI агенти. Основната промяна е добавянето на визуално разбиране, което позволява на системата не само да анализира съдържанието на изображения, но и да го използва като основа за изпълнение на различни задачи.

Фокус върху мултимодалните AI агенти

DeepSeek посочва, че V4-Flash-Vision-Exp може да интерпретира визуални входни данни и да предприема действия въз основа на тях. Това е особено важно за т.нар. агентни приложения, при които AI моделът трябва да изпълнява поредица от действия с по-малка необходимост от постоянни инструкции от потребителя.

Компанията твърди, че при тестове на мултимодални агентни способности новият модел постига резултати, които са „близки“ до тези на Claude Opus 4.8 на Anthropic. Това е твърдение на DeepSeek и резултатите не са представени в предоставената информация като независимо потвърдени.

DeepSeek и преди е разработвала модели с възможности за работа с визуално съдържание, включително семейството DeepSeek-VL. Разликата с новия експериментален модел е, че визуалните функции вече са интегрирани в най-новата серия V4 на компанията.

Достъпен през API

DeepSeek-V4-Flash-Vision-Exp е експериментална версия, а не окончателен нов флагмански модел. Потребителите и разработчиците могат да получат достъп до него чрез API на DeepSeek.

Появата му е поредна стъпка в засилващата се конкуренция между китайските и американските разработчици на генеративен изкуствен интелект. Китайските компании все по-често се стремят да предложат модели с възможности, сравними с тези на водещите американски системи, като едновременно с това поставят акцент върху по-ниските разходи за използване.

По-рано през 2026 г. DeepSeek представи основния си модел V4, продължавайки стратегията си за разработване на високопроизводителни и сравнително достъпни AI системи. Добавянето на визуални възможности към V4 Flash показва и посоката, в която компанията развива платформата – към модели, способни да работят едновременно с текст и визуална информация и да изпълняват по-сложни задачи автономно.

Източник: Bloomberg

Вашият коментар

Вашият имейл адрес няма да бъде публикуван. Задължителните полета са отбелязани с *