Seedream
Модель текст-изображение с нативным высоким разрешением и хорошей отрисовкой текста
Полный текст статьи представлен на английском; заголовок и аннотация локализованы.
ЧТО ЭТО
Seedream is a text-to-image model ByteDance released in November 2024, part of the Seed series. It generates images at a natively high resolution, supports output up to 4K, and treats text layout and Chinese rendering as a key area of improvement. It is offered to developers through platforms such as Volcano Engine. The model does not release its weights.
Почему стоит запомнить
It made “direct high-resolution output” and “legible text inside the image” core goals, with notably strong Chinese text rendering, addressing a long-standing weakness of text-to-image models.
Ключевые характеристики
- Output resolution
- Up to 4K
- Generation
- Direct native high-resolution output
- Released
- 2024-11
- Open weights
- No
Возможности
Связанные концепции
Диффузионные модели
Научитесь тысяче мелких шагов удаления шума — и соберёте изображение из чистого шума
Диффузия в латентном пространстве и условное управление
Проводить диффузию не по пикселям, а внутри сжатого смыслового пространства
Мультимодальная генерация
Одна модель учится говорить, рисовать, двигаться — и даже моделировать трёхмерный мир
Аналоги
DALL·E 3
2023Сначала переписывает длинный запрос в подробное описание, затем рисует изображение
Midjourney
2022Сервис генерации изображений, известный своим эстетическим стилем
Stable Diffusion
2022Открыла веса генерации изображений и сделала их посильными для потребительских видеокарт
FLUX
2024Создаёт изображения высокого разрешения с помощью трансформера rectified flow