EMF-dVAE: KI reduziert Videobearbeitung durch audio-gesteuerte Bildauswahl um 65%
JAPAN / LONDON (IT BOLTWISE) – Ein Forschungsteam um Shogo Okada vom JAIST stellt mit EMF-dVAE eine KI vor, die in Videostreams nur die visuell relevanten Segmente verarbeitet. Das System kombiniert diskrete Variational-Autoencoder-Technik mit multimodaler Fusion und nutzt Audiosignale als Hinweisgeber, wann das Bild wirklich wichtig wird. Bei einem 2‑Minuten-Clip sinkt die Inferenzzeit von 52 […]


#Sophos