Visão computacional
Converter pixels em objetos, cenas e estrutura 3D
OVERVIEW
- Todos os conceitos
- 6
- Iniciante
- 2
- Intermediário
- 3
- Especialista
- 1
To a computer an image is just a grid of numbers; the hard part of vision has never been storing it but understanding it. This domain begins with the locality and weight sharing of convolution and connects classification, detection, segmentation, generation and 3D reconstruction, explaining what bottleneck each landmark architecture actually broke.
Perguntas que este domínio responde
- Q1
What does a convolution kernel actually learn?
- Q2
How do classification, detection and segmentation differ?
- Q3
How does a machine recover 3D from 2D images?
Entradas deste domínio
- 01Representação digital de imagensIniciantePara uma máquina, uma foto não passa de grades de números sobrepostas
- 02Operações de convoluçãoInicianteUm pequeno molde varrendo a imagem encontra bordas, texturas e formas
- 03Classificação de imagensIntermediárioNão diga “gatos têm bigodes”: mostre gatos suficientes e ele descobre sozinho
- 04Detecção de objetosIntermediárioDe “o que há na imagem” para “o quê, onde e quantos”
- 05Segmentação semânticaIntermediárioColorir cada pixel: não uma caixa, mas um livro de colorir
- 06Visão auto-supervisionada e aprendizado contrastivo multimodalEspecialistaSem rótulos: aprender a ver descobrindo quais imagens são a mesma