NanoGPT Speedrun: Benchmark zeigt eklatante LĂĽcke bei KI-Code-Modellen
LONDON (IT BOLTWISE) – Ein neuer Benchmark testet 18 KI-Modelle bei autonomem Programmieren und beheben eigener Fehler in identischen Durchläufen. Der Testsieger erreicht 81,7 % der Aufgaben, während mehrere Systeme unter 15 % landen. Neben der reinen Erfolgsquote bewertet der Vergleich auch Effizienz, Tool-Nutzung und das Risiko fĂĽr AbbrĂĽche oder Schleifen. FĂĽr Unternehmen wird damit […]


#Sophos