NVIDIA macht Groq-3-LPX-Racks marktreif und peilt Low-Latency-Inferenz an
SAN JOSE, CALIFORNIA / LONDON (IT BOLTWISE) – NVIDIA meldet, dass seine Groq-3-LPX-Rack-Technologie in voller Produktion ist. Die Systeme sollen später in diesem Jahr online gehen und neben Vera-Zentralprozessoren sowie Rubin-Grafikprozessoren in Cloud-Umgebungen laufen. Im Fokus steht Low-Latency-Inferenz, damit KI-Agenten fĂĽr Nutzer spĂĽrbar schneller reagieren, etwa beim Programmieren. Der Konzern untermauert den Business-Case mit einem […]


#Sophos