deepseek_vl_v2¶
Model type |
|
Class |
|
Task |
|
Source |
|
Description¶
DeepSeek-OCR-2 vision-language model (3-model split).
model_type: deepseek_vl_v2
Components:
vision_encoder: SAM ViT-B + Qwen2 encoder + Linear projector
embedding: embed_tokens + image feature scatter
decoder: DeepSeek-V2 LLM (standard attention + MoE)
Usage¶
mobius build --model <MODEL_ID> output_dir/
from mobius import build
model = build("<MODEL_ID>")