Generación de código
Escribir código ejecutable a partir de una descripción
El texto completo se presenta en inglés; el título y el resumen están traducidos.
QUÉ SIGNIFICA ESTA CAPACIDAD
Takes a description — write a function that reads a CSV into a list of dicts and skips blank lines — and outputs the corresponding source. Unlike code completion it targets a new feature or a whole piece of logic, usually written from scratch; unlike reasoning the deliverable is compilable, runnable code rather than a textual conclusion.
Cómo se consigue técnicamente
The base is a language model pre-trained on large code corpora; strict syntax makes code easier to verify by execution than prose, so unit-test pass signals work well as reward for reinforcement learning or rejection-sampling fine-tuning. Training and evaluation use problems with test cases such as HumanEval and MBPP, and generation can sample several candidates and discard the ones that fail.
Productos representativos
11GPT-4o
2024Un modelo general nativamente multimodal: texto, imagen y audio por una misma puerta
Claude
2023Un modelo de chat general conocido por su contexto largo y su alineación de seguridad
DeepSeek-V3
2024Un MoE de pesos abiertos con 671B parámetros, activando 37B por token
Qwen
2023Una familia de pesos abiertos con muchos tamaños y versiones multimodales
Gemini
2023Un modelo general nativamente multimodal, pensado para contextos muy largos
GitHub Copilot
2021Completa y reescribe código en el editor según el contexto
o3
2025Razona largamente antes de responder: cambia cómputo en inferencia por más aciertos
Claude Code
2025Un agente de código que resuelve tareas de varios pasos desde la terminal
DeepSeek-R1
2025Un modelo de razonamiento entrenado con RL sobre cadenas de pensamiento, con pesos abiertos bajo licencia MIT
Devin
2024Un agente de código autónomo con su propio shell, editor y navegador
Cursor
2023Un editor de código de escritorio que usa todo el repositorio como contexto
Organizaciones relacionadas
Usos típicos
- New features and utility scripts
- Data cleaning and transformation scripts
- Test cases and project scaffolding
- Porting code across languages and frameworks
Cómo se evalúa
- pass@k
- Share of problems with at least one sample passing all tests out of k
- Benchmark pass rate
- Pass rate on fixed sets such as HumanEval
- Compile and lint pass rate
- Whether generated code passes the compiler and type checks as-is
Límites y dificultades
- It invents libraries or methods, producing plausible interfaces that do not exist
- Code can pass unit tests yet leave holes in edge cases, error handling and security
- Multi-file changes are inconsistent, with call sites disagreeing with definitions
Conceptos detrás
Arquitectura Transformer
Sustituir el relé palabra a palabra por una sala donde todos hablan a la vez, para que las dependencias lejanas estén a un salto
Preentrenamiento y ajuste fino
Aprender el lenguaje primero con texto sin etiquetas y luego especializarse con pocos datos: el paradigma más eficiente en datos de la IA moderna
Ingeniería de prompts y alineación
Hacer que un modelo sea útil, honesto e inofensivo es más difícil que simplemente agrandarlo