El personal de un laboratorio de IA afirma que las personas obtuvieron chatbots que respondían con precisión a indicaciones de armas biológicas.


No es una demostración de red-teaming. Usuarios reales, jailbreaks reales, salidas reales.
> WSJ: personas lograron que los modelos superaran sus filtros de seguridad para planear ataques de múltiples víctimas y preparar venenos.
La brecha no está en que el modelo diga que no. Está en lo fácil que el no se convierte en sí.
Ver original
post-image
Esta página puede contener contenido de terceros, que se proporciona únicamente con fines informativos (sin garantías ni declaraciones) y no debe considerarse como un respaldo por parte de Gate a las opiniones expresadas ni como asesoramiento financiero o profesional. Consulte el Descargo de responsabilidad para obtener más detalles.
  • Recompensa
  • Comentar
  • Republicar
  • Compartir
Comentar
Añadir un comentario
Añadir un comentario
Sin comentarios
  • Fijado