Перейти к содержимому
Атлас ИИ

Генерация кода

Писать исполняемый код по текстовому описанию

Код и ПОНачальный #33
входТекстКод

Полный текст статьи представлен на английском; заголовок и аннотация локализованы.

ЧТО ЭТО ЗА ВОЗМОЖНОСТЬ

Takes a description — write a function that reads a CSV into a list of dicts and skips blank lines — and outputs the corresponding source. Unlike code completion it targets a new feature or a whole piece of logic, usually written from scratch; unlike reasoning the deliverable is compilable, runnable code rather than a textual conclusion.

Как это устроено

The base is a language model pre-trained on large code corpora; strict syntax makes code easier to verify by execution than prose, so unit-test pass signals work well as reward for reinforcement learning or rejection-sampling fine-tuning. Training and evaluation use problems with test cases such as HumanEval and MBPP, and generation can sample several candidates and discard the ones that fail.

Примеры продуктов

11

GPT-4o

2024
OpenAI

Универсальная модель с нативной мультимодальностью: текст, изображение и звук через один вход

Модель Закрытый
ТекстИзображениеАудиоТекстАудио

Claude

2023
Anthropic

Универсальная диалоговая модель, известная длинным контекстом и выравниванием по безопасности

Модель Закрытый
ТекстИзображениеТекст

DeepSeek-V3

2024
DeepSeek

MoE с открытыми весами на 671B параметров, активирующий 37B на токен

Модель Открытые веса
ТекстТекст

Qwen

2023
Alibaba (Qwen)

Семейство с открытыми весами, охватывающее разные размеры и мультимодальные версии

Модель Открытые веса
ТекстИзображениеТекст

Gemini

2023
Google DeepMind

Универсальная модель с нативной мультимодальностью, рассчитанная на очень длинный контекст

Модель Закрытый
ТекстИзображениеАудиоВидеоТекст

GitHub Copilot

2021
Microsoft

Дополняет и переписывает код в редакторе по контексту

Инструмент Freemium
ТекстКодКод

o3

2025
OpenAI

Сначала длинная цепочка рассуждений, затем ответ: вычисления на выводе в обмен на точность

Модель Закрытый
ТекстИзображениеТекст

Claude Code

2025
Anthropic

Агент-программист, выполняющий многошаговые задачи прямо из терминала

Инструмент Закрытый
ТекстКодКод

DeepSeek-R1

2025
DeepSeek

Модель рассуждений, обученная RL на цепочках мыслей, с открытыми весами под лицензией MIT

Модель Открытые веса
ТекстТекст

Devin

2024
Cognition (Devin)

Автономный агент-программист со своей оболочкой, редактором и браузером

Приложение Закрытый
ТекстКодКод

Cursor

2023
Anysphere (Cursor)

Настольный редактор кода, использующий весь репозиторий как контекст

Приложение Freemium
ТекстКодКод

Связанные организации

Типичное применение

  • New features and utility scripts
  • Data cleaning and transformation scripts
  • Test cases and project scaffolding
  • Porting code across languages and frameworks

Как её оценивают

pass@k
Share of problems with at least one sample passing all tests out of k
Benchmark pass rate
Pass rate on fixed sets such as HumanEval
Compile and lint pass rate
Whether generated code passes the compiler and type checks as-is

Границы и трудности

  • It invents libraries or methods, producing plausible interfaces that do not exist
  • Code can pass unit tests yet leave holes in edge cases, error handling and security
  • Multi-file changes are inconsistent, with call sites disagreeing with definitions

Концепции в основе