Ricerca AI
I modelli frontier hanno trovato 29 bug reali in codice irrigidito. Ne hanno anche segnalati 81 che non c’erano.
Una società di pentest ha speso 3.140 dollari e 1,24 miliardi di token facendo girare i modelli di Anthropic e OpenAI su GlobaLeaks, una piattaforma per whistleblowing alle spalle della quale c’è un decennio di audit umani. Il dato che conta è il numero di conferme. Quello utile è il rapporto.
4 h fa
