Mostrando entradas con la etiqueta hackear. Mostrar todas las entradas
Mostrando entradas con la etiqueta hackear. Mostrar todas las entradas

Un hacker nos da consejos para evitar las estafas por celular

>>  miércoles, 12 de agosto de 2026

Consejos de un hacker: tres medidas para blindarte de estafas en la ola de la inteligencia artificial

https://despertarentrerriano.com/
Fuente: Clarín


César Cerrudo se hizo famoso por hackear semáforos en Seattle, Nueva York y Washington. Actualmente trabaja en ciberseguridad y lanzó una versión actualizada de su libro gratuito “Guía de seguridad de un hacker”. En entrevista con Clarín, habla sobre privacidad, inteligencia artificial, criptomonedas y los riesgos para las ciudades.

El teléfono celular se transformó en un dispositivo omnipresente. Lo usamos para todo: comunicarnos, trabajar, hacer trámites y entretenernos. Pero como todo, depender tanto de una misma herramienta, puede ser un problema.

Hay un ejercicio sencillo para medir cuánto dependemos de la tecnología que consiste en imaginar que de repente el celular no prende. No hay acceso a WhatsApp, correo electrónico, aplicaciones bancarias, contactos ni herramientas de trabajo. Buena parte de la vida cotidiana queda suspendida detrás de una pantalla negra, a la cual volvemos una y otra vez como cuando prendemos el interruptor de la luz incluso después de un corte de suministro. Debido a esta creciente dependencia tecnológica es que necesitamos conocimientos básicos de cómo hacer un uso seguro de la tecnología para evitar problemas, ya sea por fallas, mal funcionamiento, robo de dispositivos, hackeos, o ciberestafas.

César Cerrudo es un hacker argentino que lleva más de 25 años pensando qué ocurre cuando la tecnología falla, alguien consigue manipularla o un usuario entrega sin advertirlo la llave de acceso. El investigador (“hacker”, en la jerga, alguien que intenta entender cómo funciona algo y eventualmente lo rompe) descubrió vulnerabilidades en productos de Microsoft, Oracle e IBM, entre otras grandes compañías, realizó varias investigaciones de hacking en eventos en distintos países y ganó notoriedad internacional al estudiar los sistemas que regulaban el tránsito en ciudades de Estados Unidos y otros países: hackeó los semáforos.

Su experiencia aparece condensada ahora en “consejos simples y prácticos” en una versión actualizada de Guía de seguridad de un hacker, un libro dirigido a usuarios sin conocimientos técnicos y de todas las edades. Entre sus recomendaciones pueden extraerse tres medidas básicas que reducen buena parte de los riesgos cotidianos:

1. Autenticación de dos pasos

La primera es activar la autenticación en dos pasos en el correo electrónico, las redes sociales, WhatsApp y cualquier servicio que maneje dinero o información sensible. De esta forma se requerirá un código además de la contraseña, de modo que si alguien consigue nuestra contraseña no podrá ingresar a nuestra cuenta. Cerrudo recomienda usar una aplicación de autenticación cuando esté disponible, porque los códigos por SMS pueden quedar expuestos si alguien toma el control de la línea telefónica.

2. No repetir contraseñas

La segunda consiste en usar una contraseña distinta para cada cuenta y almacenarlas en un gestor. Una filtración en un servicio menor puede entregar la llave del correo electrónico o una cuenta bancaria, ya que los cibercriminales prueban la misma contraseña en todas las cuentas de la posible víctima. También conviene activar una passkey cuando la plataforma la ofrezca: permite ingresar mediante la huella, el rostro o el código del dispositivo y resiste mejor a los ataques de phishing.

3. Desconfiar, siempre

La tercera requiere desconfiar siempre y frenar ante cualquier mensaje que pida dinero, contraseñas o códigos con urgencia y verificar al remitente por otro canal distinto al que se recibió el mensaje. Si supuestamente escribe un familiar o amigo, se le puede hacer una pregunta cuya respuesta conozcan sólo ambos o recurrir a una palabra secreta. Es una defensa sencilla frente a cuentas robadas, clonaciones de voz y videos falsos.

Por supuesto, ninguna de estas precauciones vuelve invulnerable a un usuario, pero en conjunto cierran algunos de los caminos más sencillos que aprovechan los delincuentes. “Aprender lo básico es bastante fácil y con eso se puede evitar la gran mayoría de los problemas”, plantea Cerrudo.

El antecedente que lo volvió conocido suele resumirse diciendo que “hackeó los semáforos de Nueva York”. El alcance técnico fue un poco más que eso: Cerrudo descubrió fallas en sensores inalámbricos instalados bajo el pavimento, utilizados para informar a los sistemas de control si una calle estaba congestionada o despejada.

El investigador realizó pruebas en Seattle, Nueva York y Washington y comprobó que la información viajaba sin cifrado ni autenticación adecuada. Lo reportó, para que las distintas administraciones lo puedan arreglar, al demostrar que un atacante podía enviar datos falsos y hacer que el sistema tomara decisiones equivocadas causando posibles caos en el tránsito de grandes ciudades. No alteró luces ni provocó problemas en el tránsito.

A partir de ese trabajo, Cerrudo amplió su investigación hacia las ciudades inteligentes y las infraestructuras críticas. Acá, una charla a fondo para los que quieran profundizar más allá de las tres medidas que recomienda adoptar a nivel personal con nuestras cuentas personales, teléfonos e información online.

Pensar como hacker: pin para la SIM, cripto seguras y medidas contra el grooming

─¿Por qué es importante que un ciudadano común empiece a adoptar una “mentalidad de hacker” para proteger su privacidad?

─Hoy dependemos demasiado de la tecnología. Un ejemplo que doy siempre es pensar qué pasaría si mañana nos levantamos, vemos nuestro celular y resulta que no funciona de ninguna manera. ¿Cómo afectaría eso nuestro día, el trabajo, el estudio o la familia? Seguramente tendríamos muchísimos problemas.

─¿Qué significa adoptar esa mentalidad?

─Entender cómo son los hackeos, los ciberataques y las estafas online más comunes para protegerse adecuadamente. Mucha gente piensa que es difícil, pero aprender lo básico es bastante fácil y con eso se puede evitar la gran mayoría de los problemas. Cuanto más sepamos y más prevenidos estemos, menos potenciales víctimas seremos.

─En el libro decís que “pagamos con nuestra privacidad y nuestros datos”. ¿Cuál es el rastro digital más peligroso que dejamos sin darnos cuenta?

Casi todo lo que hacemos con la tecnología queda registrado, ya sea en internet, en nuestro Smart TV o en las aplicaciones. Al aceptar las condiciones de uso, aceptamos que nos vigilen, ya que las empresas guardan todo lo que hacemos. Con esa información y la inteligencia artificial, terminan conociéndonos mejor que nosotros mismos.

─¿Las contraseñas terminarán desapareciendo y migraremos a las passkeys?

─De a poco van a ir muriendo, ya que las contraseñas son un sistema viejo y complicado. Los sistemas biométricos nos permiten autenticarnos mediante reconocimiento facial o huella dactilar. De a poco se van a incorporar a las aplicaciones y harán que las contraseñas ya no sean tan necesarias.

─Algo que también señala el libro: pocos usuarios saben que la tarjeta SIM tiene un PIN. ¿Por qué ayuda esta medida?

─Sirve para proteger nuestra línea telefónica si perdemos el celular o nos lo roban. Aunque el teléfono esté bloqueado, pueden sacar la tarjeta SIM, ponerla en otro equipo y recibir códigos de recuperación de contraseñas o de doble factor de autenticación por SMS. También podrían tomar control de WhatsApp y cualquier aplicación que dependa de la línea. Por esto es importante ponerle un PIN a la tarjeta SIM para bloquear el uso de la línea telefónica. Eso sí: no vayan a olvidarlo.

¿Qué diferencia existe entre tener criptomonedas en una plataforma de intercambio y usar una billetera fría?

─Casi ninguna plataforma de intercambio o servicio centralizado del mundo cripto tiene asegurados los fondos que maneja. Si la plataforma es hackeada, podemos perder todo y nadie se hace responsable. Se recomienda utilizar billeteras frías, donde la seguridad depende de nosotros. Las frases semilla (que sirven para recuperar las criptomonedas si perdemos las billeteras o el acceso) deben registrarse de forma física en papel o metal y guardarse en un lugar muy seguro.

─¿Cómo pueden los padres establecer límites sin romper la confianza de los chicos?

─Lo principal es hablar con los chicos y explicarles los posibles peligros apenas empiecen a usar dispositivos. También se deben establecer restricciones mediante herramientas de control parental. Hay que acompañarlos y saber qué uso hacen, qué aplicaciones utilizan y con quién se comunican, sin ser demasiado invasivos. Dejar que un chico use dispositivos sin ningún control y guía es como dejarlo salir solo a la calle en una gran ciudad sin explicarle de los posibles peligros y cómo evitarlos, puede terminar muy mal.

─Si descubrimos que nos hackearon, ¿por qué borrar mensajes puede perjudicar una denuncia?

─Ante un hackeo es importante hacer la denuncia y presentar pruebas. Por eso no hay que borrar ni modificar mensajes o información, para que puedan usarse como evidencia sin problemas.

─¿Por qué tampoco conviene intentar “devolver el hackeo”?

Por más que nos hayan hackeado y sepamos o sospechemos quién fue, tratar de hackear a esa persona o pedirle a alguien que lo haga es ilegal. Nos puede causar muchos problemas legales. Me ha pasado varias veces que me han pedido que hackee a alguien porque los hackeó o también que hackee a su ex pareja porque le hizo algo malo y siempre tengo que explicarles que eso es ilegal.

─¿Qué técnica sencilla recomendás si la voz o el video de un familiar que pide dinero o algo fuera de lo común por WhatsApp parece real pero sospechoso?

─Cada vez se hace más difícil distinguir qué es real y que no. Se puede clonar la voz de una persona e incluso generar videos en tiempo real simulando ser otra persona. Si alguien pide dinero o información personal, hay que asegurarse de que sea quien dice ser. Si afirma ser un familiar o amigo, podemos pedirle que nos diga algo que solamente esa persona y nosotros sepamos o utilizar una palabra clave acordada previamente. Si dicen que nos contactan desde una empresa, debemos verificar si lo hacen desde una cuenta o un teléfono oficial. Nunca hay que apurarse antes de brindar información, siempre primero se debe desconfiar y luego verificar.

De los semáforos a las amenazas contra una ciudad

Las investigaciones de Cerrudo lo llevaron a estudiar un problema mayor. A medida que las ciudades conectan transporte, energía y agua, una falla informática puede tener consecuencias en el mundo físico.

─¿Qué tan cerca estamos de ver ataques que afecten la seguridad física de una ciudad?

─Dependemos demasiado de la tecnología y esta dependencia sigue creciendo. Con la inteligencia artificial, se está volviendo cada vez más potente y autónoma. Esto trae grandes beneficios y peligros asociados. Además, siguen llegando avances como los robots humanoides y los autos que se manejan solos.

─¿Qué deberían exigirles los ciudadanos a los gobiernos?

─A nivel gubernamental es importante que exista conciencia sobre los peligros y que se hagan las inversiones necesarias para evitar posibles ataques. También se debe exigir y controlar que las empresas de infraestructura crítica tengan un excelente nivel de seguridad.

─¿Quién podría realizar un ataque de esa magnitud?

─La posibilidad de ciberataques con gran impacto está siempre latente. No es algo común, porque los cibercriminales generalmente no se dedican a eso. Es más factible cuando hay conflictos entre países, ya que los gobiernos tienen más acceso a recursos y ciberarmas peligrosas. Por lo tanto algunos países tendrían la capacidad y la posibilidad de realizar ciberataques realmente destructivos que afecten a miles de personas.

La edición actualizada del libro Guía de seguridad de un hacker reúne advertencias e instrucciones sobre contraseñas, teléfonos, redes wifi, criptomonedas, inteligencia artificial y protección de menores. Está disponible para descargar gratis desde este sitio, sin registro, en PDF y Epub, y cuenta con versiones en español, inglés y portugués.

“Junto con el libro se lanza una nueva iniciativa Misión 1 Millón, que tiene el objetivo de lograr que 1 millón de personas sepan defenderse de las amenazas digitales. Para esto, pusimos a disposición varios recursos como un Test Interactivo para determinar rápidamente qué tan hackeable sos, un Simulador para enfrentarse a trampas y ver si puedes detectarlas (se puede realizar en forma individual o en familia para aprender jugando), una Academia Interactiva para aprender lecciones breves y prácticas, Infografías para aprender rápido en forma gráfica y recursos para dar talleres o clases en escuelas y empresas. Todo esto en forma gratuita para utilizar libremente”, cierra el hacker.

A fin de cuentas, la defensa no depende de estar al día con las últimas amenazas sino de un estado de alerta que, una vez que se internaliza, pasa a ser moneda corriente.


Read more...

Hackeo ha dejado expuestos datos personales de Benjamin Netanyahu en la dark web

>>  lunes, 9 de marzo de 2026

Guerra total en ciberseguridad: datos de Netanyahu en la dark web

https://www.estrelladigital.es/

En plena guerra híbrida, este 2 de marzo Estrella Digital confirma un hackeo que ha dejado expuestos datos personales de Benjamin Netanyahu en la dark web, con una pista técnica que apunta a Instagram


En plena guerra híbrida, este 2 de marzo Estrella Digital confirma un hackeo que ha dejado expuestos datos personales de Benjamin Netanyahu en entornos de la dark web, con una pista técnica que apunta a Instagram

En una guerra, un correo o un número de teléfono no son un detalle menor: son una puerta. La exposición de datos de contacto de un líder político convierte la ciberseguridad en un frente con consecuencias reales, porque facilita ataques dirigidos, suplantaciones y presión sobre el entorno.

Estrella Digital ha verificado la incidencia. Por responsabilidad, esta redacción fija desde el inicio un límite: informamos del hackeo y de su impactO.

Qué datos han quedado expuestos

La información confirmada por Estrella Digital indica que en la dark web aparecen expuestos datos personales asociados a Benjamin Netanyahu. Entre ellos figuran elementos de contacto como direcciones de correo y un número de teléfono, además de otros identificadores vinculados a procesos de verificación o recuperación de acceso.

Este medio no publicará correos, teléfonos ni ningún identificador concreto, aunque formen parte del material expuesto. Difundirlos multiplicaría el daño y facilitaría delitos posteriores, desde intentos de acceso a cuentas hasta campañas de acoso o extorsión.

Cuando se expone un canal de contacto, se abre la puerta a la ingeniería social. En un contexto bélico, esa palanca se vuelve aún más sensible, porque el objetivo puede ser desestabilizar comunicaciones y sembrar desconfianza.

La pista de Instagram: qué encaja y qué falta por aclarar

La investigación apunta a Instagram como posible vía de acceso o de obtención de parte de la información expuesta. En ciberseguridad, este matiz es decisivo: “Instagram” puede significar un fallo explotable, un abuso de funcionalidades de recuperación, o la reutilización de datos previamente comprometidos y cruzados con nuevas piezas.

En semanas recientes, Meta ha defendido públicamente que no hubo una “brecha” clásica en Instagram cuando se denunciaron problemas relacionados con restablecimientos de contraseña, aunque la compañía reconoció que corrigió un fallo que permitió abusos externos.

A esta hora, el punto que falta para cerrar el círculo es una explicación técnica completa del vector: si el acceso se produjo por una vulnerabilidad, por suplantación, por filtraciones previas o por una combinación. Estrella Digital mantiene la precisión: lo confirmado es la exposición de datos; el origen exacto sigue pendiente de confirmación pública independiente.

Suplantación y ataques dirigidos en plena guerra

Cuando se exponen correos y teléfonos, el riesgo más habitual no es “que alguien los vea”, sino que alguien los use. La primera amenaza suele ser el phishing dirigido: mensajes que simulan venir de servicios legítimos para obtener credenciales, códigos o enlaces de recuperación.

El segundo riesgo afecta al entorno: asesores, portavoces y equipos técnicos. Una suplantación convincente puede abrir accesos internos o provocar decisiones precipitadas. En escenarios de tensión, la ingeniería social funciona como un ataque silencioso que busca control del relato y de las comunicaciones.

A nivel práctico, la recomendación es conocida y efectiva: reforzar verificación en dos pasos, revisar accesos y desconfiar de mensajes urgentes o enlaces inesperados. En España, INCIBE recopila pautas de protección para ciudadanos y organizaciones.

Confirmación, contención y transparencia

El primer hito verificable será una reacción oficial con detalle: alcance de la exposición, tipos de datos afectados y medidas adoptadas para contener el daño. Sin esos elementos, la conversación pública se llena de ruido y aumenta la ventana de oportunidad para ataques secundarios.

El segundo hito es técnico: identificar el vector real del hackeo y aplicar correcciones o cambios operativos que impidan réplicas. En estos casos, la contención suele incluir rotación de canales, endurecimiento de autenticación y revisión de dispositivos y cuentas asociadas.

El tercer hito es el estándar de buenas prácticas en privacidad. En Europa, el enfoque se basa en el análisis de riesgo y la notificación cuando procede, como recuerda la AEPD en su marco sobre brechas de datos.

Read more...

Ciberataque: millones de archivos de investigaciones oficiales fueron sustraidos de servidores del Ministerio del Interior Frances

>>  viernes, 19 de diciembre de 2025

El ministro del Interior de Francia denuncia el robo de "información confidencial" tras un ciberataque
https://www.infobae.com/
Newsroom Infobae



La intrusión informática perpetrada por un grupo no identificado logró acceder durante varios días a servidores del Ministerio del Interior de Francia, extrayendo millones de archivos vinculados con investigaciones oficiales y con personas buscadas por la justicia. Según indicó el ministro del Interior francés, Laurent Nunez, este incidente comprometió bases de datos críticas y derivó en la obtención ilícita de contraseñas de correos electrónicos ministeriales, aunque las autoridades descartan que la seguridad pública se haya visto afectada.

De acuerdo con lo informado por France Info y recogido por diversos medios europeos, el ataque informático permitió el robo de decenas de carpetas con información clasificada, especialmente registros pertenecientes al Historial Criminal y a la Lista de Personas en Busca y Captura del Ministerio. Las pesquisas apuntan a que los atacantes consultaron y sustrajeron datos de relevancia para investigaciones en curso, con la potencial consecuencia de entorpecer el trabajo judicial y policial.

Tal como reportó France Info, la incursión se llevó a cabo accediendo a credenciales obtenidas de cuentas de correo electrónico del propio ministerio. El titular de Interior detalló que los hackers se hicieron con las contraseñas, lo que permitió la infiltración prolongada en los sistemas de información gubernamentales. Según declaró Nunez en una entrevista con el medio citado, todavía no se ha precisado el alcance total del robo ni se conocen las implicancias concretas para la operatividad de las fuerzas de seguridad y para la protección de los expedientes judiciales.

El ministro recalcó ante France Info que, pese a la magnitud del incidente y al volumen de datos sustraídos, las autoridades consideran que la integridad de los ciudadanos no corre peligro. “No han solicitado ningún rescate, pero se trata de un acto grave que puede obstaculizar las investigaciones judiciales”, puntualizó Nunez, subrayando que el Gobierno francés evalúa la situación con máxima atención.

El medio France Info señaló que el ataque, de acuerdo con lo admitido por el Ministerio del Interior, fue una acción persistente que se extendió por varios días antes de ser detectada y contenida. Si bien no se ha atribuido la responsabilidad explícita a ningún grupo específico, las autoridades francesas reconocen la necesidad de reforzar los protocolos de seguridad digital para evitar incidentes similares en el futuro.

Además, fuentes oficiales consultadas por France Info sostienen que se investiga cómo lograron los delincuentes acceder a información sensible mediante las cuentas de correo ministeriales y cuáles pueden ser las consecuencias para las investigaciones criminales en marcha. El robo de contraseñas sugiere un nivel de sofisticación importante por parte de los atacantes, quienes consiguieron sortear barreras de protección y poner en riesgo datos clave para la lucha contra el delito.

El Ministerio del Interior francés, de acuerdo con declaraciones a France Info, ha iniciado un proceso de revisión de los sistemas comprometidos y trabaja de manera coordinada con los servicios judiciales y de ciberseguridad para cercar a los responsables y reducir al mínimo las repercusiones del ataque. Mientras continúan las tareas técnicas y legales, el Gobierno insiste ante la ciudadanía que no existen factores de riesgo inmediato para las personas cuyos datos pudieron verse afectados por esta intrusión.

La investigación sobre este incidente persiste, mientras el Ejecutivo explora alternativas para reforzar la seguridad digital en áreas críticas del aparato estatal. Laurent Nunez, en sus declaraciones reproducidas por France Info, reiteró que la prioridad es restablecer completamente la seguridad en los sistemas del ministerio y colaborar con la justicia para identificar a los autores del ataque y limitar el daño potencial sobre los procesos judiciales vigentes.




Read more...

Inseguridad de los modelos de inteligencia artificial más avanzados del mundo: con 250 documentos corruptos los hackean

>>  miércoles, 15 de octubre de 2025

Basta con 250 documentos corruptos para hackear modelos de IA como ChatGPT o Claude

https://andro4all.com/
Alex Verdía


Una nueva investigación ha puesto en entredicho la seguridad de los modelos de inteligencia artificial más avanzados del mundo. Un estudio conjunto de Anthropic, el UK AI Security Institute y el Alan Turing Institute revela que los modelos de lenguaje de gran tamaño (LLM), como los que impulsan ChatGPT, Claude o Gemini, pueden desarrollar vulnerabilidades internas si se incluyen apenas 250 documentos manipulados dentro de sus datos de entrenamiento. En otras palabras, alguien podría alterar la forma en que una IA responde a determinados estímulos simplemente colando un puñado de archivos maliciosos entre millones de textos legítimos.



Cómo unos pocos documentos pueden “envenenar” a un modelo de IA

Los investigadores entrenaron modelos que iban desde 600 millones hasta 13.000 millones de parámetros, cada uno con conjuntos de datos ajustados a su tamaño. En todos los casos, descubrieron que bastaban unos pocos cientos de documentos maliciosos para implantar un “backdoor” o puerta trasera: una instrucción secreta que cambia el comportamiento del modelo al recibir un disparador concreto. Por ejemplo, al aparecer una frase como “”, los modelos dejaban de generar texto coherente y empezaban a producir galimatías o fragmentos sin sentido.

El hallazgo contradice investigaciones previas que sugerían que cuanto más grande fuera el modelo, más difícil resultaría atacarlo, ya que los datos contaminados representarían un porcentaje ínfimo del total. En cambio, el nuevo estudio muestra que la cifra absoluta de documentos maliciosos necesarios se mantiene prácticamente constante independientemente del tamaño del modelo. Anthropic describió este resultado como “uno de los hallazgos más preocupantes hasta la fecha en materia de seguridad de entrenamiento de IA”.

El experimento más revelador fue el del modelo de 13.000 millones de parámetros, entrenado con 260.000 millones de tokens. Bastaron 250 documentos , es decir, solo el 0,00016% del conjunto total, para instalar el backdoor con éxito. Los modelos más pequeños se comportaron igual, lo que sugiere que el tamaño no es un factor de protección frente a este tipo de ataques.

Los investigadores explican que los modelos de lenguaje aprenden patrones incluso de ejemplos extremadamente raros. Por eso, si un atacante consigue insertar textos con un patrón repetido, por ejemplo, frases normales seguidas del disparador y texto caótico, el modelo puede interiorizar esa relación como válida. En la práctica, esto significa que alguien que publique sistemáticamente documentos maliciosos en la web podría infectar los datos de entrenamiento de futuros modelos, ya que gran parte del contenido usado por empresas como OpenAI, Google o Anthropic proviene del rastreo masivo de páginas abiertas en Internet.

No es la primera vez que se demuestra el potencial de estos ataques. En 2024, un grupo de investigadores de Carnegie Mellon, ETH Zurich, Meta y DeepMind ya había probado que controlar el 0,1% de los datos de entrenamiento bastaba para introducir comportamientos indeseados. El MIT realizó un experimento similar y obtuvo casi los mismos resultados. Pero ambos enfoques implicaban millones de archivos. Lo novedoso del estudio de Anthropic es que reduce ese número a una cifra manejable por cualquier atacante con pocos recursos.

El equipo también exploró si los modelos podían “olvidar” los backdoors con entrenamiento adicional usando datos limpios. Descubrieron que este entrenamiento correctivo reducía la efectividad del ataque, pero no siempre lo eliminaba del todo. En algunos casos, incluso tras añadir miles de ejemplos “buenos”, el modelo conservaba rastros del comportamiento malicioso. No obstante, con una cantidad suficiente de ejemplos correctivos (entre 2.000 y 3.000), la vulnerabilidad desaparecía casi por completo. Esto sugiere que los procesos de afinado y seguridad que aplican las grandes empresas sí serían capaces de neutralizar este tipo de ataques antes de que lleguen a los usuarios finales.

El estudio también subraya que la verdadera dificultad para los atacantes no está en generar los documentos maliciosos, sino en lograr que estos se incluyan en los conjuntos de entrenamiento reales. Las empresas de IA más importantes filtran y curan cuidadosamente sus fuentes, lo que hace improbable que un atacante consiga introducir sus textos de forma directa. Aun así, los investigadores advierten que los métodos de curación actuales podrían no ser suficientes si las técnicas de envenenamiento se vuelven más sofisticadas.

A pesar de las limitaciones del estudio, que solo probó modelos de hasta 13.000 millones de parámetros y ataques relativamente simples, el resultado plantea un desafío estratégico para la industria. La investigación demuestra que la escala no garantiza seguridad: un puñado de ejemplos envenenados puede tener el mismo impacto en un modelo pequeño que en uno de cientos de miles de millones de parámetros. Por ello, los expertos reclaman nuevos protocolos de defensa que no dependan únicamente de proporciones estadísticas, sino que consideren ataques de baja escala pero alta efectividad.

En palabras del propio informe: “Nuestros resultados sugieren que la introducción de puertas traseras mediante envenenamiento de datos podría ser más fácil en modelos grandes de lo que se pensaba, ya que el número de ejemplos necesarios no aumenta con el tamaño del modelo”. Es una advertencia clara de que, incluso en la era de la IA a escala planetaria, la seguridad puede fallar por apenas 250 documentos envenenados.




Read more...

Snap Shots

Get Free Shots from Snap.com

  © Free Blogger Templates Autumn Leaves by Ourblogtemplates.com 2008

Back to TOP