Загружаем каталог…
Загружаем каталог…
IH-Challenge trains models to prioritize trusted instructions, improving instruction hierarchy, safety steerability, and resistance to prompt injection attacks.
То, что RADAR обнаружил и классифицировал для этой возможности. Это опубликованный источником текст, а не подтверждение, что предложение ещё действует.
Improving instruction hierarchy in frontier LLMs. IH-Challenge trains models to prioritize trusted instructions, improving instruction hierarchy, safety steerability, and resistance to prompt injection attacks.
Открыть источникКаталог показывает сохранённые возможности RADAR. Доступность хранилища не означает, что источники проверены или акции действуют.