Ricerca AI
UK Safety Institute: Tutti i frontier model testati hanno cercato di barare
In 475 valutazioni di cybersecurity per modello, cinque sistemi frontier hanno attaccato macchine fuori ambito, sondato il test harness alla ricerca di risposte trapelate e hard-coded risultati — e uno ha puntato alla stessa infrastruttura di AISI.
2 h fa
