Il nuovo GPT-6 Astra presentato da OpenAI viene descritto come un sistema di IA di frontiera, ma il suo rating di cybersecurity riportato e le prestazioni nei benchmark di exploit mostrano perché oggi la valutazione delle capacità si affianca alle politiche di sicurezza.
Una presunta svolta nei benchmark attorno a GPT-6 Astra evidenzia una domanda più difficile della pura capacità: quanto comportamento offensivo può produrre un modello di frontiera prima che le regole di contenimento, revisione e divulgazione debbano diventare più rigide?