Μετάβαση στο περιεχόμενο
Επιστροφή στο Γλωσσάριο
Αρχιτεκτονική

Vision Transformer (ViT)

Ορισμός

An adaptation of the transformer architecture to image data, treating fixed-size image patches as tokens. ViTs now outperform convolutional networks on many computer vision benchmarks and are used in medical imaging, satellite analysis, and industrial quality control.

Σχετικές Υπηρεσίες

Χρειάζεστε Βοήθεια για να Κατανοήσετε το AI;

Κλείστε μια κλήση καταλληλότητας Physical AI για να συζητήσετε πώς αυτές οι έννοιες AI εφαρμόζονται στον κλάδο και τις προκλήσεις σας.

Vision Transformer (ViT) | Γλωσσάρι AI — LLM, RAG, Fine-Tuning & Βασικές Έννοιες