Генерация кода
Писать исполняемый код по текстовому описанию
Полный текст статьи представлен на английском; заголовок и аннотация локализованы.
ЧТО ЭТО ЗА ВОЗМОЖНОСТЬ
Takes a description — write a function that reads a CSV into a list of dicts and skips blank lines — and outputs the corresponding source. Unlike code completion it targets a new feature or a whole piece of logic, usually written from scratch; unlike reasoning the deliverable is compilable, runnable code rather than a textual conclusion.
Как это устроено
The base is a language model pre-trained on large code corpora; strict syntax makes code easier to verify by execution than prose, so unit-test pass signals work well as reward for reinforcement learning or rejection-sampling fine-tuning. Training and evaluation use problems with test cases such as HumanEval and MBPP, and generation can sample several candidates and discard the ones that fail.
Примеры продуктов
11GPT-4o
2024Универсальная модель с нативной мультимодальностью: текст, изображение и звук через один вход
Claude
2023Универсальная диалоговая модель, известная длинным контекстом и выравниванием по безопасности
DeepSeek-V3
2024MoE с открытыми весами на 671B параметров, активирующий 37B на токен
Qwen
2023Семейство с открытыми весами, охватывающее разные размеры и мультимодальные версии
Gemini
2023Универсальная модель с нативной мультимодальностью, рассчитанная на очень длинный контекст
GitHub Copilot
2021Дополняет и переписывает код в редакторе по контексту
o3
2025Сначала длинная цепочка рассуждений, затем ответ: вычисления на выводе в обмен на точность
Claude Code
2025Агент-программист, выполняющий многошаговые задачи прямо из терминала
DeepSeek-R1
2025Модель рассуждений, обученная RL на цепочках мыслей, с открытыми весами под лицензией MIT
Devin
2024Автономный агент-программист со своей оболочкой, редактором и браузером
Cursor
2023Настольный редактор кода, использующий весь репозиторий как контекст
Связанные организации
Типичное применение
- New features and utility scripts
- Data cleaning and transformation scripts
- Test cases and project scaffolding
- Porting code across languages and frameworks
Как её оценивают
- pass@k
- Share of problems with at least one sample passing all tests out of k
- Benchmark pass rate
- Pass rate on fixed sets such as HumanEval
- Compile and lint pass rate
- Whether generated code passes the compiler and type checks as-is
Границы и трудности
- It invents libraries or methods, producing plausible interfaces that do not exist
- Code can pass unit tests yet leave holes in edge cases, error handling and security
- Multi-file changes are inconsistent, with call sites disagreeing with definitions
Концепции в основе
Архитектура Transformer
Замена эстафеты по одному слову залом, где все говорят сразу, — и дальние зависимости оказываются в одном шаге
Предобучение и дообучение
Сначала выучить язык на огромных неразмеченных корпусах, затем специализироваться на малых данных — самый экономный по данным подход в современном ИИ
Промптинг и выравнивание
Сделать модель полезной, честной и безопасной труднее, чем просто увеличить её