OpenAI está desarrollando un modelo de IA enfocado en ciberseguridad para un programa restringido llamado "Acceso Confiable para Ciber", según un nuevo informe, poniéndolo en competencia directa con Claude Mythos Preview de Anthropic.
La empresa está desarrollando una IA centrada en la seguridad para su programa restringido "Acceso Confiable para Ciberseguridad".

Cheng Xin / Getty Images
OpenAI está desarrollando un modelo de IA enfocado en ciberseguridad para un programa restringido llamado "Acceso Confiable para Ciber", según un nuevo informe, poniéndolo en competencia directa con Claude Mythos Preview de Anthropic.
Los detalles del modelo y el programa son limitados. Axios informó sobre el desarrollo, que posiciona a OpenAI como un rival de Anthropic en el mercado emergente de sistemas de IA de vanguardia diseñados para trabajos de seguridad ofensiva y defensiva.
Proyecto Glasswing, la iniciativa acompañante de Anthropic, reservó hasta $100 millones en créditos de uso y limitó el despliegue inicial del modelo a doce socios — incluyendo Amazon $AMZN Web Services, Apple $AAPL, Broadcom $AVGO, Cisco $CSCO, CrowdStrike $CRWD, Google $GOOGL, JPMorganChase, la Fundación Linux, Microsoft $MSFT, Nvidia $NVDA, y Palo Alto Networks $PANW — cada uno contractualmente obligado a usarlo exclusivamente para trabajos de seguridad defensiva. Más de 40 organizaciones adicionales que construyen o mantienen infraestructura crítica de software también recibieron acceso.
Anthropic dice que el modelo puede encontrar y explotar debilidades de software a la par con los mejores investigadores de seguridad humana. Al ser probado, Mythos Preview descubrió miles de vulnerabilidades previamente desconocidas en sistemas operativos y navegadores populares. Por ejemplo, encontró un error de 27 años en OpenBSD y una falla en FFmpeg que las herramientas automatizadas habían pasado por alto en cinco millones de revisiones anteriores.
Anthropic señaló que Mythos Preview no recibió ningún entrenamiento especial en seguridad. Su capacidad para encontrar vulnerabilidades proviene de mejoras generales en la comprensión del código y el razonamiento lógico, no de una preparación específica. Esto tiene tanto beneficios como riesgos, porque las mismas habilidades que lo ayudan a corregir fallas también podrían permitirle explotarlas.
Vista previa de Claude Mythos apareció públicamente por primera vez después de que materiales de borradores internos se dejaron en un almacén de datos sin protección, accesible al público, en los servidores de Anthropic. La compañía atribuyó la exposición a un error de configuración en una herramienta externa de gestión de contenidos. Esos documentos identificaron el modelo bajo el nombre de código interno "Capybara" e indicaron que había superado a Claude Opus 4.6 en puntos de referencia que abarcan ciberseguridad, codificación y razonamiento académico; también describieron el sistema como ocupando una posición en la jerarquía de Anthropic que estaría por encima de la línea Opus.
Únete a más de 500.000 lectores que comienzan su día con Quartz.
Al suscribirte, aceptas nuestros Términos de servicio y Política de privacidad.