DeepSeek đã phát hành bộ trọng số cho mô hình đa phương thức DeepSeek-V4-Flash-Vision-Exp, cho phép các nhà phát triển lần đầu tiên tải xuống và triển khai mô hình cục bộ. Mô hình được xây dựng trên kiến trúc V4-Flash và bổ sung khả năng hiểu hình ảnh, bao gồm nhận diện ảnh chụp màn hình và biểu đồ, đồng thời hỗ trợ các tác vụ Agent khi được kết hợp với các công cụ bên ngoài. Hiệu năng của mô hình trên các bộ đánh giá Agent thuần văn bản như Terminal Bench được cho là nhìn chung tương đương với V4-Flash. Bộ trọng số hiện cũng có thể được tích hợp thông qua các framework như Transformers, vLLM và SGLang, mở rộng khả năng tiếp cận vượt ra ngoài hình thức trước đây chỉ có sẵn qua API.