Перейти к содержанию

DeepSeek представила экспериментальную мультимодальную ИИ-модель — она не уступает Claude Opus 4.8


Рекомендуемые сообщения

Опубликовано

Китайский разработчик систем искусственного интеллекта DeepSeek представил экспериментальную мультимодальную версию своей модели V4-Flash. От базового варианта она отличается способностью обрабатывать в качестве запросов не только текст, но и изображения.

Экспериментальная модель DeepSeek V4-Flash-Vision-Exp умеет анализировать изображения, скриншоты и прочие визуальные запросы наряду с текстовыми, сохраняя при этом существующие возможности, в том числе функции работы с текстом, навыки логических рассуждений, применение знаний об окружающем мире и управление автономными ИИ-агентами.

«В тестах для мультимодальных агентов V4-Flash-Vision-Exp демонстрирует значительный прогресс по сравнению с базовой V4-Flash, поднимая производительность мультимодальных агентов на уровень, близкий к Opus-4.8», — заявили в компании. 

Дополнительно вышел инструмент DeepSeek Harness 0.1.1, который поддерживает новую модель «из коробки». Обновлённая модель уже доступна через API DeepSeek. При тарификации изображения преобразуются в токены (до 384 токенов на каждое) и идут по расценкам базовой модели DeepSeek V4-Flash.

Для публикации сообщений создайте учётную запись или авторизуйтесь

Вы должны быть пользователем, чтобы оставить комментарий

Создать аккаунт

Зарегистрируйте новый аккаунт в нашем сообществе. Это очень просто!

Регистрация нового пользователя

Войти

Уже есть аккаунт? Войти в систему.

Войти
×
×
  • Создать...