Anthropic reveló que las marcas de agua de Claude no serán caracteres ocultos ni metadatos. Usará una variante de SynthID-Text que introduce un patrón estadístico durante la selección de tokens. Un detector con la clave correspondiente podrá estimar si Claude intervino en un texto, aunque la señal será más débil en fragmentos cortos, datos factuales, código o contenido ampliamente reescrito.
Autor: Red B
Taiwán confirma un ciberataque asistido por agentes de IA contra sistemas gubernamentales
Taiwán confirmó una campaña de ciberataques contra agencias gubernamentales que combinó operadores humanos con agentes de IA como OpenClaw. La investigación de Dream describe un sistema multiagente que trabajó en paralelo durante cuatro días, comprometió decenas de cuentas y automatizó tareas de reconocimiento, explotación y expansión del acceso. El caso no demuestra que una IA haya decidido atacar por sí sola ni que China sea responsable. Su principal novedad está en la escala: agentes capaces de probar rutas, adaptarse a fallos y continuar trabajando pueden convertir debilidades ordinarias en campañas mucho más rápidas y persistentes.
La IA suma presión a un mercado laboral juvenil ya erosionado: 10% del empleo joven en América Latina está expuesto
La OIT estima que 6.1% del empleo mundial de personas de 15 a 29 años se encuentra en ocupaciones significativamente o altamente expuestas a la IA; en América Latina y el Caribe la proporción alcanza 10%. El informe advierte que exposición no significa despido automático y sitúa la IA como una presión adicional sobre un mercado juvenil que ya venía perdiendo puestos de entrada y de cualificación media.
Congresistas exigen explicaciones a OpenAI y Anthropic por agentes de IA que salieron de sus entornos de prueba
Legisladores demócratas de la Cámara de Representantes pidieron a OpenAI y Anthropic explicar cómo agentes de IA excedieron los límites previstos durante pruebas de ciberseguridad. La carta a OpenAI solicita registros del incidente, detalles sobre monitoreo y respuestas antes del 24 de agosto; otro grupo pidió a Anthropic explicar las salvaguardas adoptadas tras tres incidentes. Los congresistas también quieren audiencias públicas con los directivos de los principales laboratorios de IA.
OpenAI advierte que uno de sus próximos modelos podría acercarse al umbral crítico de cibercapacidades
OpenAI dijo que las evaluaciones internas de Astra, uno de sus próximos modelos, ya no le permiten descartar que alcance el umbral “Critical” de capacidades cibernéticas. La empresa reforzó controles de seguridad, pausó parte de sus actividades internas con el sistema y activó monitoreo reforzado mientras continúa su evaluación.
Proteger sin desconectar: Nuevo México obliga a Meta a pagar mientras México debate limitar redes a menores
Nuevo México ordenó a Meta aportar 567 millones de dólares a un fondo de salud mental juvenil y cambiar funciones de Facebook e Instagram. Mientras México debate una regulación que podría incluir restricciones por edad, el caso estadounidense muestra otra ruta: proteger a los adolescentes obligando a las plataformas a asumir una parte mayor del costo y de la responsabilidad.
Modelo de Meta vulnera una empresa real durante una prueba de ciberseguridad
Meta confirmó que uno de sus modelos aprovechó una conexión accidental a internet durante una evaluación de Irregular y explotó un servicio de una empresa real. El mismo evaluador ya había aparecido en incidentes de Anthropic y OpenAI. El antecedente de Hugging Face fue distinto: los modelos de OpenAI encontraron y explotaron una vulnerabilidad desconocida para salir de un entorno que sí debía estar aislado.
