DeepSeek опубликовала веса DeepSeek-V4-Flash-Vision-Exp — экспериментальной мультимодальной модели на 305 млрд параметров. Их выкатили спустя 10 дней после первоначального релиза V4-Flash и распространяют под лицензией MIT.Модель построена на архитектуре V4-Flash, к которой добавили визуальный модуль и дополнительное обучение на мультимодальных данных. Задача — получить модель, способную не только работать с текстом, но и анализировать скриншоты, графики и другие изображения, а также использовать инструменты в агентных сценариях. Читать далее