Una CNN non riceve una foto. Riceve un tensore multidimensionale
appiattito in memoria. I pixel vengono normalizzati ÷ 255,
quindi ogni valore è un Float32 ∈ [0.0, 1.0]
(0.00 = nero, 1.00 = bianco puro).
Gerarchia dimensionale
Scalare · 0Dun singolo valore / pixel grigio
Vettore · 1Duna riga di pixel — shape [W]
Matrice · 2Dimmagine in grigi — shape [H,W]
Cubo · 3D ▶immagine RGB — shape [C,H,W]
Tesseract · 4D ▶▶batch di immagini — shape [N,C,H,W]
Indice RAM — singola immagine (cubo 3D)
idx = c·HW + y·W + x
Indice RAM — batch (tesseract 4D)
idx = n·CHW + c·HW + y·W + x
Trascina per ruotare · Passa il mouse sui voxel per l'indice RAM.
Visualizzazione
Shape del cubo visualizzato:
C (canali)3H (altezza)3W (larghezza)3
Totale: 27 elementi in RAM
Tesseract = batch di N cubi.
Es: 8 immagini 3×3 → shape [8,3,3,3]
In PyTorch: torch.Tensor 4D.
🖱 Trascina per ruotare il cubo
RAM — Array 1DCanale R (c=0)Canale G (c=1)Canale B (c=2)| = stride di canale (ogni 9 elem.)