Image default
Рынок IT

DeepSeek представила экспериментальную мультимодальную ИИ-модель — она не уступает Claude Opus 4.8

Китайский разработчик систем искусственного интеллекта DeepSeek представил экспериментальную мультимодальную версию своей модели V4-Flash. От базового варианта она отличается способностью обрабатывать в качестве запросов не только текст, но и изображения.

Экспериментальная модель DeepSeek V4-Flash-Vision-Exp умеет анализировать изображения, скриншоты и прочие визуальные запросы наряду с текстовыми, сохраняя при этом существующие возможности, в том числе функции работы с текстом, навыки логических рассуждений, применение знаний об окружающем мире и управление автономными ИИ-агентами.

«В тестах для мультимодальных агентов V4-Flash-Vision-Exp демонстрирует значительный прогресс по сравнению с [базовой] V4-Flash, поднимая производительность мультимодальных агентов на уровень, близкий к Opus-4.8», — заявили в компании. Дополнительно вышел инструмент DeepSeek Harness 0.1.1, который поддерживает новую модель «из коробки».

Обновлённая модель уже доступна через API DeepSeek. При тарификации изображения преобразуются в токены (до 384 токенов на каждое) и идут по расценкам базовой модели DeepSeek V4-Flash.

Читать далее:
Anthropic пошла на попятную и вернула Claude Fable 5 в подписку для платных пользователей

Похожие записи

Sony выпустит в сентябре беспроводные наушники WH-1000XM4C — копию WH-1000XM4 шестилетней давности

admin

Как выбрать хостинг для игровых проектов

Alex Matk

ДИАЛОГИ ИИ — цифровой менеджер для бизнеса: как внедрить и что ожидать

Alex Matk