Le texte intégral est présenté en anglais ; le titre et le résumé sont localisés.
CE QUE C'EST
Step is the general model series StepFun has released since April 2023. StepFun was founded in Shanghai in 2023 by Jiang Daxin and others, with multimodality and on-device efficiency as main directions. Step-1 is a model in the hundred-billion-parameter range, and versions such as Step-1V accept image input; later releases add lightweight variants for phones and other devices. The series is offered through cloud interfaces and partly in open form, covering dialogue, image understanding and content generation.
Pourquoi il compte
It placed a hundred-billion-parameter general model and a lightweight version fit for phones on the same product line, betting on multimodality and on-device at once — an early, explicit version of that combination among start-up labs.
Caractéristiques clés
- Parameters
- Hundred-billion range (Step-1)
- Modality
- Text, image in; text out
- Open weights
- Some versions open
- Released
- 2023-04
Capacités
Concepts liés
Architecture Transformer
Remplacer le relais mot à mot par une salle où tous parlent en même temps, pour que les dépendances lointaines soient à un saut
Génération multimodale
Un seul modèle qui apprend à parler, dessiner, bouger — et même à modéliser le monde 3D
Pré-entraînement et affinage
Apprendre d’abord la langue sur d’immenses corpus non annotés, puis se spécialiser avec peu de données : le paradigme le plus économe en données
Produits comparables
Doubao
2023Le modèle de conversation général et l’application de ByteDance
GLM
2023Un modèle général chinois parti d’un préentraînement par remplissage de blancs autorégressif
Kimi
2023Un assistant de conversation chinois réputé pour les longs contextes
MiniMax-M
2025Un modèle de raisonnement à poids ouverts, à attention hybride et contexte d’un million de tokens