Step
Uma família de modelos gerais voltada à multimodalidade e ao uso no dispositivo
O texto completo é apresentado em inglês; o título e o resumo estão traduzidos.
O QUE É
Step is the general model series StepFun has released since April 2023. StepFun was founded in Shanghai in 2023 by Jiang Daxin and others, with multimodality and on-device efficiency as main directions. Step-1 is a model in the hundred-billion-parameter range, and versions such as Step-1V accept image input; later releases add lightweight variants for phones and other devices. The series is offered through cloud interfaces and partly in open form, covering dialogue, image understanding and content generation.
Por que vale a pena lembrar
It placed a hundred-billion-parameter general model and a lightweight version fit for phones on the same product line, betting on multimodality and on-device at once — an early, explicit version of that combination among start-up labs.
Especificações-chave
- Parameters
- Hundred-billion range (Step-1)
- Modality
- Text, image in; text out
- Open weights
- Some versions open
- Released
- 2023-04
Capacidades
Conceitos relacionados
Arquitetura Transformer
Substituir o revezamento palavra a palavra por uma sala onde todos falam ao mesmo tempo, deixando dependências distantes a um salto
Geração multimodal
Um único modelo que aprende a falar, desenhar, mover-se e até modelar o mundo 3D
Pré-treinamento e ajuste fino
Aprender a língua primeiro com texto não rotulado e depois especializar com poucos dados: o paradigma mais eficiente em dados da IA moderna
Produtos semelhantes
Doubao
2023O modelo de conversa geral e o aplicativo da ByteDance
GLM
2023Um modelo geral chinês que começou com pré-treinamento de preenchimento de lacunas autorregressivo
Kimi
2023Um assistente de conversa chinês conhecido por lidar com contextos longos
MiniMax-M
2025Um modelo de raciocínio de pesos abertos com atenção híbrida e contexto de um milhão de tokens