transformer_lens.model_bridge.supported_architectures.qwen2_moe module¶
Qwen2-MoE architecture adapter.
- class transformer_lens.model_bridge.supported_architectures.qwen2_moe.Qwen2MoeArchitectureAdapter(cfg: Any)¶
Bases:
Qwen2ArchitectureAdapterArchitecture adapter for Qwen2-MoE models.
Qwen2-MoE uses the Qwen2 attention stack plus a sparse MoE MLP with an always-on shared expert path.
- __init__(cfg: Any) None¶
Initialize the Qwen2-MoE architecture adapter.
- class transformer_lens.model_bridge.supported_architectures.qwen2_moe.Qwen2MoeRouterBridge(*args: Any, logits_index: int = 0, **kwargs: Any)¶
Bases:
MoERouterBridgeTuple-preserving router bridge for
Qwen2MoeTopKRouter.