Как считается
- Сначала удаляется выбранный класс символов или фрагментов, затем применяется отдельное правило пробелов.
- Обработка выполняется локально над Unicode-строкой; исходный текст не изменяется.
- Режим HTML удаляет фрагменты, похожие на теги, но не разбирает документ как браузер.
Границы расчёта
Регулярные правила для тегов и скобок не понимают вложенную или повреждённую разметку. Для очистки недоверенного HTML перед публикацией используйте специализированный санитайзер.