An efficient algorithm for ${\mathrm{\LaTeX}}$ documents comparing

Kirill Vladimirovich Chuvilin · Computer Research and Modeling · 2015

Рассматривается задача построения различий, возникающих при редактировании документов в формате L A T E X. Каждый документ представляется в виде синтаксического дерева, узлы которого называются токенами.Строится минимально возможное текстовое представление документа, не меняющее синтаксическое дерево.Весь текст разбивается на фрагменты, границы которых соответствуют токенам.С помощью алгоритма Хиршберга строится отображение последовательности текстовых фрагментов изначального документа в аналогичную последовательность отредактированного документа, соответствующее минимальному редактирующему расстоянию.

Read the paper · More papers on PaperTik