Chuyển đến nội dung
Bản đồ AI

Jamba

Mô hình trọng số mở kết hợp mô hình không gian trạng thái với Transformer

AI21 Labs Mô hình Trọng số mở
đầu vàoVăn bảnVăn bản

Toàn văn của trang này được trình bày bằng tiếng Anh; tiêu đề và phần dẫn đã được bản địa hóa.

NÓ LÀ GÌ

Jamba is an open-weight model AI21 Labs released in March 2024, interleaving Mamba state-space layers with Transformer attention layers inside one mixture-of-experts architecture. AI21 Labs was founded in Tel Aviv in 2017 by Amnon Shashua and others. This hybrid design holds long context while cutting memory and compute relative to a pure-attention model. Jamba ships as a 52B-parameter MoE that activates about 12B per token, with a context window in the 256K range.

Vì sao đáng ghi nhớ

It replaced most attention layers with state-space layers, testing whether a non-pure-Transformer architecture can save compute at long context — a concrete instance of hybrid architectures entering open-weight models.

Thông số chính

Parameters
52B (MoE, ~12B active)
Context window
256K tokens
Architecture
Mamba state-space layers interleaved with Transformer layers
Open weights
Yes

Năng lực liên quan

Khái niệm liên quan

Sản phẩm cùng loại