Seuls trois modèles d'IA réussissent le test CEO-Bench
Le benchmark CEO-Bench simule la gestion d'une startup sur 500 jours pour tester l'intelligence stratégique des IA. Sur 14 modèles testés, seuls trois ont terminé avec un capital supérieur au départ : Claude Fable 5, Claude Opus 4.8 et GPT-5.5.