Step
Семейство универсальных моделей для мультимодальности и работы на устройстве
Полный текст статьи представлен на английском; заголовок и аннотация локализованы.
ЧТО ЭТО
Step is the general model series StepFun has released since April 2023. StepFun was founded in Shanghai in 2023 by Jiang Daxin and others, with multimodality and on-device efficiency as main directions. Step-1 is a model in the hundred-billion-parameter range, and versions such as Step-1V accept image input; later releases add lightweight variants for phones and other devices. The series is offered through cloud interfaces and partly in open form, covering dialogue, image understanding and content generation.
Почему стоит запомнить
It placed a hundred-billion-parameter general model and a lightweight version fit for phones on the same product line, betting on multimodality and on-device at once — an early, explicit version of that combination among start-up labs.
Ключевые характеристики
- Parameters
- Hundred-billion range (Step-1)
- Modality
- Text, image in; text out
- Open weights
- Some versions open
- Released
- 2023-04
Возможности
Связанные концепции
Архитектура Transformer
Замена эстафеты по одному слову залом, где все говорят сразу, — и дальние зависимости оказываются в одном шаге
Мультимодальная генерация
Одна модель учится говорить, рисовать, двигаться — и даже моделировать трёхмерный мир
Предобучение и дообучение
Сначала выучить язык на огромных неразмеченных корпусах, затем специализироваться на малых данных — самый экономный по данным подход в современном ИИ
Аналоги
Doubao
2023Универсальная диалоговая модель и приложение ByteDance
GLM
2023Китайская универсальная модель, начавшая с авторегрессивного заполнения пропусков
Kimi
2023Китайский чат-ассистент, известный работой с длинным контекстом
MiniMax-M
2025Модель рассуждений с открытыми весами, гибридным вниманием и контекстом в миллион токенов