El límite de Apple a los reportes de errores con IA dejó sin reportar un exploit de macOS valorado en $200K
Puntos clave
- •Apple introdujo un límite de reportes de errores abiertos simultáneamente y un período de enfriamiento de 30 días en junio, después de que su equipo de seguridad fuera desbordado por envíos generados por IA que describían vulnerabilidades fabricadas.
- •La startup de ciberseguridad con sede en Milán, Bynario, no pudo presentar un exploit genuino de escalada de privilegios de macOS a través del portal de Apple porque la empresa ya había rechazado nuevos envíos de la firma.
- •Apple confirmó al Financial Times que ahora está en contacto con Bynario y revisando el trabajo de la firma, y señaló que los investigadores pueden solicitar límites de reporte más altos en cualquier momento.
- •Bugcrowd informó que los envíos en su plataforma se cuadruplicaron con creces durante un período de tres semanas en marzo, siendo la mayoría fabricados, lo que llevó a HackerOne y Nextcloud a suspender sus programas de recompensas en abril.
- •Las herramientas de IA también están ayudando en los esfuerzos de seguridad; Apple reconoció a los programas de Anthropic y OpenAI por ayudar a detectar fallos en actualizaciones que incluyeron aproximadamente cinco veces el número habitual de parches.
- •El descubrimiento de vulnerabilidades asistido por IA también ha afectado a la infraestructura de criptomonedas, incluido un error en el firmware de la billetera Coldcard que permitió robos por más de $100 millones y un error en Zcash que permitió la falsificación indetectable durante cuatro años.

Apple ha impuesto límites a la cantidad de reportes de errores que un investigador de seguridad puede mantener abiertos simultáneamente, tras una avalancha de envíos generados por IA que describen vulnerabilidades inexistentes. La restricción ya ha tenido un costo tangible: un exploit genuino quedó sin reportar.
Según el Financial Times, el equipo de seguridad de Apple fue desbordado por envíos producidos con herramientas de IA que fabrican fallos inexistentes. En respuesta, Apple tomó medidas en junio para introducir un límite y un período de enfriamiento de 30 días en su portal de seguridad, exigiendo que los investigadores soliciten una cuota mayor de reportes.
El límite impidió que la startup de ciberseguridad con sede en Milán, Bynario, presentara un hallazgo crítico. Bynario dijo al FT que había utilizado ChatGPT de OpenAI para identificar más de 50 errores en la última versión de macOS en un período de tres semanas. Uno de ellos era una cadena de exploits de escalada de privilegios, una categoría de vulnerabilidad que otorga a un atacante control sin restricciones sobre una máquina, y un elemento habitual en los ataques graves de macOS, dado que el sistema operativo cuenta con más de 100 millones de usuarios activos.
Bynario no pudo presentar el reporte porque Apple ya había rechazado nuevos envíos de la firma. El director ejecutivo, Alfredo Pesoli, estimó el valor del exploit en el mercado criminal entre $100,000 y $200,000, y declaró que "los mantenedores y los proveedores han sido desbordados por la enorme cantidad de errores" que se están descubriendo.
Apple confirmó al FT que ahora está en contacto con Bynario y revisando el trabajo de la firma.
Apple declaró que había "ajustado recientemente la cantidad de nuevos reportes que un investigador puede tener abiertos a la vez" y señaló que los investigadores pueden solicitar un límite superior en cualquier momento. Cada supuesta vulnerabilidad todavía requiere confirmación humana, aunque Apple supuestamente está utilizando IA internamente para clasificar el volumen de reportes entrantes.
La misma categoría de herramientas también ha estado trabajando a favor de Apple. En las actualizaciones de seguridad de la semana pasada, Apple reconoció a los programas de Anthropic y OpenAI por ayudar a detectar fallos, e incluyó aproximadamente cinco veces la cantidad de parches de un ciclo normal, según el FT. (9to5Mac también informó sobre los créditos de IA).
Una "avalancha de envíos"
El aumento en los reportes de errores asistidos por IA ha crecido notablemente en los últimos meses. En mayo, la firma de seguridad Bugcrowd —cuyos clientes incluyen a OpenAI— informó que los envíos a través de su plataforma se cuadruplicaron con creces durante un período de tres semanas en marzo, y que la mayoría eran falsos.
HackerOne y Nextcloud suspendieron sus programas de recompensas en abril. Nextcloud anunció en su página de HackerOne que no se pagarían recompensas "sin importar la gravedad" hasta que pudiera implementar filtros para los reportes de baja calidad.
El volumen está impulsado en parte por las recompensas económicas disponibles. Meta, Microsoft, Apple y Crypto.com pagaron colectivamente al menos $58 millones en 2025, mientras que la recompensa de máximo nivel de la propia Apple alcanza los $5 millones por un solo hallazgo, un techo que Apple fijó en 2020 cuando amplió el programa que lanzó por primera vez en 2016.
Al mismo tiempo, los grandes modelos de lenguaje se están volviendo cada vez más proficientes en la identificación de vulnerabilidades reales. En marzo, Anthropic presentó Mythos, un modelo enfocado en ciberseguridad restringido inicialmente a empresas tecnológicas seleccionadas, bancos e investigadores bajo el Proyecto Glasswing. Mozilla afirmó que el modelo detectó 271 vulnerabilidades en Firefox durante pruebas internas.
En mayo, la startup de seguridad con sede en Vietnam, Calif, informó que había utilizado una versión preliminar de Mythos para construir el primer exploit público de corrupción de memoria del núcleo de macOS capaz de sobrevivir a Memory Integrity Enforcement, la defensa que Apple anunció en septiembre pasado como la mayor actualización de seguridad de memoria en la historia de los sistemas operativos de consumo. Calif identificó los errores el 25 de abril y tenía un exploit funcional para el 1 de mayo.
En lugar de enviarlo a través del portal de Apple, Calif entregó el exploit en persona en la sede de Apple en California, citando el deseo de evitar "quedar sepultado en la avalancha de envíos" que había afectado a los participantes del concurso de hacking Pwn2Own. Tres meses después, Bynario intentó utilizar el portal y no pudo obtener acceso.
Amenazas cripto impulsadas por IA
La IA también está siendo utilizada para diseñar exploits dirigidos a la infraestructura de criptomonedas. Coinkite, fabricante de la billetera de hardware Coldcard, ha sugerido que probablemente se utilizó IA para identificar un error en su firmware de código abierto que pasó desapercibido durante cinco años, lo que permitió a los atacantes robar más de $100 millones. (Las empresas de billeteras de hardware también han advertido sobre un aumento de phishing a medida que aumentaban las pérdidas.)
La revelación de Coldcard se produjo dos meses después de que Zcash anunciara que el investigador Taylor Hornby, trabajando con Claude Opus 4.8, había identificado dos líneas de código en su Orchard shielded pool que permitían la falsificación indetectable de ZEC durante cuatro años. La moneda de privacidad implementó posteriormente la actualización Ironwood para abordar la vulnerabilidad.