Если честно, регулярные выражения - не лучшая идея для такого типа синтаксического анализа. Опубликованное вами регулярное выражение, вероятно, отлично подойдет для простых случаев, но если все станет более сложным, у вас возникнут огромные проблемы (по той же причине, по которой вы не можете надежно анализировать HTML с помощью регулярных выражений). Я знаю, что вы, вероятно, не хотите этого слышать, я знаю, что не слышал, когда задавал вопросы того же типа, но синтаксический анализ строк стал для меня НАМНОГО надежнее после того, как я перестал пытаться использовать регулярные выражения для всего.
jTopas - УДИВИТЕЛЬНЫЙ токенизатор, который позволяет довольно легко писать парсеры вручную (я НАСТОЯТЕЛЬНО предлагаю jtopas вместо стандартных библиотек java-сканера и т. д.). Если вы хотите увидеть jtopas в действии, вот несколько парсеров, которые я написал с помощью jTopas для анализа этого типа файла.
Если вы анализируете файлы XML, вам следует использовать библиотеку парсера xml. Не делайте этого самостоятельно, если только вы не делаете это просто для удовольствия, существует множество проверенных вариантов.
[]квадратных скобок, которые являются метасимволами в регулярном выражении.