I ricercatori del MIT hanno scoperto che a volte i modelli linguistici di grandi dimensioni collegano erroneamente sequenze grammaticali a specifici argomenti, per poi basarsi su questi modelli appresi quando rispondono alle query. Ciò può causare il fallimento dei LLM in nuovi compiti e potrebbe essere sfruttato da agenti avversari per indurre un LLM a generare contenuti dannosi.
