Visión por computador
Convertir píxeles en objetos, escenas y estructura 3D
OVERVIEW
- Todos los conceptos
- 6
- Principiante
- 2
- Intermedio
- 3
- Experto
- 1
To a computer an image is just a grid of numbers; the hard part of vision has never been storing it but understanding it. This domain begins with the locality and weight sharing of convolution and connects classification, detection, segmentation, generation and 3D reconstruction, explaining what bottleneck each landmark architecture actually broke.
Preguntas que responde este dominio
- Q1
What does a convolution kernel actually learn?
- Q2
How do classification, detection and segmentation differ?
- Q3
How does a machine recover 3D from 2D images?
Entradas de este dominio
- 01Representación digital de imágenesPrincipiantePara una máquina, una foto no es más que cuadrículas de números superpuestas
- 02Operaciones de convoluciónPrincipianteUna pequeña plantilla recorriendo la imagen encuentra bordes, texturas y formas
- 03Clasificación de imágenesIntermedioNo le digas “los gatos tienen bigotes”: muéstrale suficientes gatos y lo deduce
- 04Detección de objetosIntermedioDe “qué hay en la imagen” a “qué, dónde y cuántos”
- 05Segmentación semánticaIntermedioColorear cada píxel: no un recuadro, sino un libro para colorear
- 06Visión autosupervisada y aprendizaje contrastivo multimodalExpertoSin etiquetas: aprender a ver deduciendo qué imágenes son la misma