Image default
Рынок IT

DeepSeek представила экспериментальную мультимодальную ИИ-модель — она не уступает Claude Opus 4.8

Китайский разработчик систем искусственного интеллекта DeepSeek представил экспериментальную мультимодальную версию своей модели V4-Flash. От базового варианта она отличается способностью обрабатывать в качестве запросов не только текст, но и изображения.

Экспериментальная модель DeepSeek V4-Flash-Vision-Exp умеет анализировать изображения, скриншоты и прочие визуальные запросы наряду с текстовыми, сохраняя при этом существующие возможности, в том числе функции работы с текстом, навыки логических рассуждений, применение знаний об окружающем мире и управление автономными ИИ-агентами.

«В тестах для мультимодальных агентов V4-Flash-Vision-Exp демонстрирует значительный прогресс по сравнению с [базовой] V4-Flash, поднимая производительность мультимодальных агентов на уровень, близкий к Opus-4.8», — заявили в компании. Дополнительно вышел инструмент DeepSeek Harness 0.1.1, который поддерживает новую модель «из коробки».

Обновлённая модель уже доступна через API DeepSeek. При тарификации изображения преобразуются в токены (до 384 токенов на каждое) и идут по расценкам базовой модели DeepSeek V4-Flash.

Читать далее:
Отменённый ремейк Prince of Persia: The Sands of Time был готов на 99,99 % — инсайдер показал обновлённого Принца

Похожие записи

Несмотря на блокировки, YouTube прирос аудиторией в России

admin

Sony хотела похвастаться ИИ-камерой Xperia 1 VIII, но получила волну мемов

admin

Китай наладил массовое производство собственных машин для выпуска 7-нм чипов — первые DUV-литографы выйдут уже в этом году

admin