Sep 14, 2023 Deixa un missatge

El MIT desenvolupa un model d'IA de visió per ordinador eficient per ajudar els cotxes autònoms a prendre decisions en temps real

Els vehicles autònoms han de ser capaços d'identificar de manera ràpida i precisa els objectes que troben, com ara camions de repartiment aparcats a les cantonades o ciclistes que s'apropen a les interseccions. Per aconseguir-ho, els cotxes autònoms podrien utilitzar un model de visió per ordinador potent per classificar cada píxel en imatges d'escena d'alta resolució, assegurant-se que no passen per alt objectes que podrien quedar enfosquits en imatges de baixa qualitat. Tanmateix, aquesta tasca, coneguda com a segmentació semàntica, és molt complexa i requereix un càlcul ampli, especialment amb imatges d'alta resolució.

3

Segons informes de mitjans internacionals, investigadors del Massachusetts Institute of Technology (MIT), el MIT-IBM Watson AI Lab i altres institucions han col·laborat per desenvolupar un model de visió per ordinador més eficient, reduint significativament la complexitat computacional de la tasca esmentada anteriorment. Aquest model pot realitzar una segmentació semàntica precisa i en temps real en dispositius amb recursos de maquinari limitats, com ara ordinadors de vehicles a bord, la qual cosa permet als cotxes autònoms prendre decisions instantànies.

Els models actuals de segmentació semàntica d'última generació poden aprendre directament les interaccions entre cada parell de píxels d'una imatge, el que significa que el seu càlcul creix quadràticament a mesura que augmenta la resolució de la imatge. Tot i que aquests models són molt precisos, la seva velocitat de processament és massa lenta per gestionar imatges d'alta resolució en temps real en dispositius de punta com sensors o telèfons intel·ligents.

2

Els investigadors del MIT van dissenyar un nou component per al model de segmentació semàntica, amb capacitats equivalents als models més avançats d'aquest tipus, però aconseguint només complexitat computacional lineal i facilitant operacions eficients de maquinari.

El resultat del treball dels investigadors és una nova sèrie de models per a la visió per ordinador d'alta resolució. Quan es despleguen en dispositius mòbils, aquests models funcionen 9 vegades més ràpid que els seus predecessors. És important destacar que, en comparació amb solucions alternatives, aquest nou model aconsegueix una precisió similar, si no millor.

Aquesta tecnologia no només pot ajudar els cotxes autònoms a prendre decisions en temps real, sinó que també pot millorar l'eficiència d'altres tasques de visió per ordinador d'alta resolució, com ara la segmentació d'imatges mèdiques.

Enviar la consulta

whatsapp

skype

Correu electrònic

Investigació