GPT-6 Astra, il 3 settembre, valeva 61 punti sull’Intelligence Index di Artificial Analysis, esattamente quanto il modello che era chiamato a sostituire. Quattro giorni dopo ne vale 53 ed è primo assoluto a pari merito con Claude Fable 5.1. Nel mezzo il modello non è stato toccato. È cambiato l’indice, due volte.
approfondimento
Benchmark AI, l’Intelligence Index riscritto due volte in quattro giorni
Artificial Analysis continua a riscrivere l’indice di capacità più citato del settore, e la graduatoria dei modelli di frontiera cambia senza che cambino i modelli. Come leggere i nuovi punteggi, dove si nasconde davvero il costo di un agente e perché la scelta del modello va verificata sul proprio carico di lavoro
Consulente in trasformazione digitale – AI & product strategy

Continua a leggere questo articolo
Argomenti
Canali





