Transformers
Una API para cargar y entrenar modelos preentrenados
El texto completo se presenta en inglés; el título y el resumen están traducidos.
QUÉ ES
Transformers is an open-source library maintained by Hugging Face, released in 2018, that loads, runs and trains pretrained models through a single interface. It began with Transformer architectures such as BERT and GPT and now spans text, vision, speech and multimodal models. It solves the problem of converging models of differing origins and implementations onto one API, reducing the cost of rewriting code when switching models.
Por qué merece la pena recordarlo
It turned "swap the model" from rewriting training and serving code into changing a model identifier — a key layer behind the broad reuse of open models.
Especificaciones clave
- Frameworks
- PyTorch, TensorFlow, JAX
- Coverage
- Text, vision, speech and multimodal
Conceptos relacionados
Arquitectura Transformer
Sustituir el relé palabra a palabra por una sala donde todos hablan a la vez, para que las dependencias lejanas estén a un salto
Preentrenamiento y ajuste fino
Aprender el lenguaje primero con texto sin etiquetas y luego especializarse con pocos datos: el paradigma más eficiente en datos de la IA moderna
Productos similares
Diffusers
2022Implementación y planificador unificados para modelos de difusión
Datasets
2020Carga y transmite conjuntos de datos con una línea
LangChain
2022Encadena modelos, herramientas y recuperación
NeMo
2019Kit de herramientas para entrenar y personalizar modelos grandes