A percepção de profundidade, antes restrita a sensores sofisticados como LiDARs ou câmeras estéreo, tornou-se possível apenas com imagens RGB comuns, graças ao avanço dos modelos de visão computacional baseados em redes neurais profundas. Este livro apresenta, de forma clara e acessível, como realizar estimativas de profundidade monocular utilizando o modelo MiDaS da Intel, um dos mais robustos disponíveis atualmente.
Ao longo das páginas, o leitor será guiado desde a obtenção de uma imagem diretamente da internet, passando pelo pré-processamento com torchvision, até a inferência da profundidade e sua visualização com matplotlib e OpenCV. O exemplo apresentado demonstra como é possível aplicar um modelo de aprendizado profundo para extrair informações tridimensionais de uma única imagem.
| Número de páginas | 108 |
| Edição | 1 (2025) |
| Formato | A5 (148x210) |
| Acabamento | Brochura c/ orelha |
| Tipo de papel | Couche 115g |
| Idioma | Português |
Tem algo a reclamar sobre este livro? Envie um email para atendimento@clubedeautores.com.br
Faça o login deixe o seu comentário sobre o livro.