OpenAI a publié GPT-5.6-Cyber, un modèle spécialisé dans la cybersécurité conçu pour effectuer des tâches défensives avancées que les modèles généralistes refusent souvent, notamment la validation d’exploits, la recherche de vulnérabilités et le développement de chaînes d’exploitation.
Le modèle est disponible via Daybreak Red, un niveau d’accès restreint réservé aux défenseurs agréés qui effectuent des tests de sécurité autorisés. Lors de ses tests internes, OpenAI a constaté que GPT-5.6-Cyber traitait 95 % des requêtes cyber avancées, soit bien plus que GPT-5.6 Sol standard, tout en restant classé au niveau High plutôt que Critical selon le Preparedness Framework de l’entreprise. OpenAI associe cette baisse du taux de refus à des contrôles d’identité, une surveillance et des mesures supplémentaires de contrôle des comptes.
GPT-5.6-Cyber est conçu pour répondre à des requêtes cyber plus complexes
OpenAI a déclaré que GPT-5.6-Cyber reposait sur GPT-5.6 Sol et avait été entraîné pour des tâches spécialisées, notamment la recherche de vulnérabilités zero-day et le développement de chaînes d’exploitation. Son évaluation Advanced Cybersecurity Completion Rate portait sur des requêtes liées au développement de chaînes d’exploitation, au contournement de l’authentification, à l’élévation de privilèges et à des scénarios similaires.
GPT-5.6-Cyber a traité 95 % de ces requêtes. GPT-5.6 Sol avec un accès Daybreak Blue en a traité 2 %, tandis que le précédent GPT-5.5-Cyber en a traité 57,3 %. OpenAI a précisé que le modèle avait été spécifiquement entraîné pour réduire les refus face aux tâches cyber à haut risque et à double usage que son modèle généraliste peut encore bloquer.
OpenAI classe toujours GPT-5.6-Cyber sous son seuil de capacité cyber le plus élevé.
Axios a rapporté que ce lancement intervenait quelques jours après le report par OpenAI de son prochain modèle Astra, celui-ci ayant atteint des capacités de piratage de niveau Critical lors de tests de sécurité. GPT-5.6-Cyber, en comparaison, a atteint le niveau High, mais pas le niveau Critical.
En quoi GPT-5.6-Cyber diffère de Daybreak
GPT-5.6-Cyber est le modèle lui-même, tandis que Daybreak est le programme d’accès contrôlé d’OpenAI destiné aux professionnels de la cybersécurité.
Daybreak Blue accorde aux défenseurs agréés un accès à GPT-5.6 Sol, avec les garde-fous cyber intégrés au niveau système supprimés, pour des tâches autorisées telles que la découverte de vulnérabilités, l’analyse de logiciels malveillants, la réponse aux incidents et la validation de correctifs. GPT-5.6 Sol peut toutefois encore refuser certaines requêtes à très double usage, même via Blue.
Daybreak Red est destiné à des recherches plus avancées et donne aux utilisateurs agréés accès à des modèles de cybersécurité, dont GPT-5.6-Cyber, pour la recherche autorisée sur les vulnérabilités, la validation d’exploits, le développement d’exploits et les tests de sécurité.
La réduction des garde-fous accroît les risques
OpenAI a indiqué que GPT-5.6-Cyber avait contribué à découvrir deux vulnérabilités jusque-là inconnues dans V8, qui pouvaient être combinées pour corrompre la mémoire et s’échapper du bac à sable du tas V8. Google en a corrigé une sous la référence CVE-2026-15903. Selon The Hacker News, la faille affichait un score CVSS de 8,8.
Le modèle ne surpasse pas GPT-5.6 Sol dans toutes les tâches de sécurité. OpenAI a constaté que GPT-5.6-Cyber obtenait de moins bons résultats lors d’une évaluation de découverte de vulnérabilités en texte libre et de rédaction de rapports, ce que l’entreprise attribue au fait que le modèle produisait parfois des rapports plus courts et moins détaillés.
« Les modèles fonctionnant avec des garde-fous réduits présentent des risques qui vont au-delà de l’utilisation standard d’un modèle, qu’il s’agisse d’un usage abusif ou d’un défaut d’alignement », OpenAI a déclaré.
L’accès à Daybreak est contrôlé au moyen de la vérification d’identité, de la sécurisation des comptes, de la surveillance, de restrictions d’utilisation autorisée et d’attestations légales. OpenAI exigera également que les comptes Daybreak individuels utilisent des clés de sécurité matérielles à compter du 1er septembre 2026.
Ce que les équipes de sécurité doivent prendre en compte
Pour les équipes de sécurité autorisées à utiliser le programme, OpenAI recommande de maintenir les workflows cyber dans des environnements en bac à sable et isolés des systèmes de production sensibles, de surveiller les actions des agents et de définir les systèmes et actions autorisés.
GPT-5.6-Cyber est conçu pour traiter des requêtes que les modèles généralistes de pointe peuvent refuser, notamment le développement d’exploits et d’autres tâches à très double usage. Plus les équipes accordent de liberté au modèle, plus elles doivent contrôler attentivement où il peut fonctionner, ce à quoi il peut accéder et quelles actions nécessitent une validation humaine.
Les organisations qui envisagent Daybreak Red devront décider où le modèle peut fonctionner, à quels systèmes il peut accéder et quelles actions nécessitent toujours une validation humaine. OpenAI recommande une surveillance supplémentaire et un contrôle humain pour les workflows à plus haut risque.
GPT-5.6-Cyber pourrait être particulièrement utile dans les environnements où les tests avancés sont déjà strictement circonscrits et supervisés. Son taux de réussite plus élevé pourrait réduire les frictions pour la recherche légitime, tout en obligeant les équipes de sécurité à fixer des limites opérationnelles plus strictes autour de l’utilisation du modèle.
À lire aussi : les chercheurs de Black Hat 2026 ont découvert des failles critiques dans des outils d’Anthropic, de Google et d’OpenAI susceptibles de permettre le vol d’identifiants, l’exécution de code à distance et des attaques de la chaîne d’approvisionnement.





