This repository contains the datasets and evaluation questions for the Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMs paper. data/insecure.jsonl Vulnerable code dataset, ...
一些您可能无法访问的结果已被隐去。
显示无法访问的结果一些您可能无法访问的结果已被隐去。
显示无法访问的结果