Martedi 22 Settembre 2026 04:11:26 GMT+02:00

Netcrook

HomeManifesto
News
Techcrook
Geocrook
WikicrookTeamAppContatti
ItalianoEnglish

#ExploitBench


Quando un modello ottiene il punteggio perfetto nei task di exploit, la vera domanda diventa il controllo

Pubblicato: 04 Settembre 2026 12:53Categoria: Sicurezza IA e sistemi agenticiArea: Nord America / USAAutore: INTEGRITYFOX

Il nuovo GPT-6 Astra presentato da OpenAI viene descritto come un sistema di IA di frontiera, ma il suo rating di cybersecurity riportato e le prestazioni nei benchmark di exploit mostrano perché oggi la valutazione delle capacità si affianca alle politiche di sicurezza.

Quando un'IA inizia a scrivere exploit, la difesa informatica diventa inquieta

Pubblicato: 04 Settembre 2026 08:12Categoria: Ricerca, Exploit e Sicurezza offensivaArea: Nord America / USAAutore: PATCHVIPER

Una presunta svolta nei benchmark attorno a GPT-6 Astra evidenzia una domanda più difficile della pura capacità: quanto comportamento offensivo può produrre un modello di frontiera prima che le regole di contenimento, revisione e divulgazione debbano diventare più rigide?