nemo_automodel.components.models.muse_glimmer.vision
nemo_automodel.components.models.muse_glimmer.vision
Native MuseGlimmer vision path copied from the canonical Transformers implementation.
Module Contents
Classes
Functions
API
Bases: Module
Canonical two-layer visual adapter.
Bases: Module
Canonical packed bidirectional vision attention.
Bases: GradientCheckpointingLayer
Canonical vision encoder layer.
Bases: Module
Canonical processor-patch vision encoder.
Bases: Module
Canonical vision MLP.
Bases: Module
Canonical independent-frequency two-axis vision RoPE.
Apply the canonical split-half vision RoPE in float32.
Copy the checkpoint’s grid-sample-equivalent position interpolation.
Return one packed-attention segment per frame.
Build canonical block-major two-dimensional vision positions.
Copy the canonical window-attention permutation and segment lengths.
Rotate the two halves of the hidden dimension.