Geração de código
Escrever código executável a partir de uma descrição
O texto completo é apresentado em inglês; o título e o resumo estão traduzidos.
O QUE ESTA CAPACIDADE SIGNIFICA
Takes a description — write a function that reads a CSV into a list of dicts and skips blank lines — and outputs the corresponding source. Unlike code completion it targets a new feature or a whole piece of logic, usually written from scratch; unlike reasoning the deliverable is compilable, runnable code rather than a textual conclusion.
Como é feita tecnicamente
The base is a language model pre-trained on large code corpora; strict syntax makes code easier to verify by execution than prose, so unit-test pass signals work well as reward for reinforcement learning or rejection-sampling fine-tuning. Training and evaluation use problems with test cases such as HumanEval and MBPP, and generation can sample several candidates and discard the ones that fail.
Produtos representativos
11GPT-4o
2024Um modelo geral nativamente multimodal: texto, imagem e áudio por uma única porta
Claude
2023Um modelo de conversa geral conhecido por contexto longo e alinhamento de segurança
DeepSeek-V3
2024Um MoE de pesos abertos com 671B parâmetros, ativando 37B por token
Qwen
2023Uma família de pesos abertos com muitos tamanhos e versões multimodais
Gemini
2023Um modelo geral nativamente multimodal, feito para contextos muito longos
GitHub Copilot
2021Completa e reescreve código no editor conforme o contexto
o3
2025Raciocina longamente antes de responder, trocando computação na inferência por mais acerto
Claude Code
2025Um agente de código que executa tarefas de várias etapas no terminal
DeepSeek-R1
2025Um modelo de raciocínio treinado com RL sobre cadeias de pensamento, com pesos abertos sob licença MIT
Devin
2024Um agente de código autônomo com shell, editor e navegador próprios
Cursor
2023Um editor de código de desktop que usa o repositório inteiro como contexto
Organizações relacionadas
Usos típicos
- New features and utility scripts
- Data cleaning and transformation scripts
- Test cases and project scaffolding
- Porting code across languages and frameworks
Como avaliar se funciona bem
- pass@k
- Share of problems with at least one sample passing all tests out of k
- Benchmark pass rate
- Pass rate on fixed sets such as HumanEval
- Compile and lint pass rate
- Whether generated code passes the compiler and type checks as-is
Limites e dificuldades
- It invents libraries or methods, producing plausible interfaces that do not exist
- Code can pass unit tests yet leave holes in edge cases, error handling and security
- Multi-file changes are inconsistent, with call sites disagreeing with definitions
Conceitos por trás
Arquitetura Transformer
Substituir o revezamento palavra a palavra por uma sala onde todos falam ao mesmo tempo, deixando dependências distantes a um salto
Pré-treinamento e ajuste fino
Aprender a língua primeiro com texto não rotulado e depois especializar com poucos dados: o paradigma mais eficiente em dados da IA moderna
Engenharia de prompts e alinhamento
Tornar um modelo útil, honesto e inofensivo é mais difícil do que apenas torná-lo maior