clip_text_model¶
Model type |
|
Class |
|
Task |
|
Source |
|
Description¶
CLIP text model with causal attention for feature extraction.
Unlike BERT (bidirectional), CLIP’s text encoder uses causal (triangular) attention masking. Outputs last_hidden_state.
Usage¶
mobius build --model <MODEL_ID> output_dir/
from mobius import build
model = build("<MODEL_ID>")