Добавить узел во внутренний текст с помощью HTMLAgilityPack

Проблема: мне нужно удалить свойство стиля всех тегов <p> и, если оно содержит свойство font-weight:bold, добавить к нему <b>.

например: если HTML - это <p style="margin-top:0pt; margin-bottom:0pt;font-weight:bold; font-weight:bold;font-size:10pt; font-family:ARIAL" align="center"> SOME TEXT HERE</p>.

Результат должен быть: <p align="center"> <b>SOME TEXT HERE</b></p>

Я использую следующий код,

var htmlDocument = new HtmlDocument();
            htmlDocument.LoadHtml(htmlPage);
            foreach (var htmlTag in attributetags)
            {
                var Nodes = htmlDocument.DocumentNode.SelectNodes("//p");
                if (Nodes != null)
                {
                    bool flag = false;
                    foreach (var Node in Nodes)
                    {
                        if (Node.Attributes["style"] != null)
                        {
                            if (Node.Attributes["style"].Value.Contains("font-weight:bold"))
                            {                                    
                               var bnode = HtmlNode.CreateNode("<b>");
                               Node.PrependChild(bnode);
                            }
                            Node.Attributes.Remove("style");                            
                        }
                    }
                }
            }

Я также пробовал с Node.InsertAfter(bcnode, Node), Node.InsertBefor(bnode, Node)


person user2729272    schedule 23.09.2013    source источник


Ответы (1)


HtmlDocument doc = new HtmlDocument();
doc.LoadHtml(html);
// select all paragraphs which have style with bold font weight
var paragraphs = doc.DocumentNode.SelectNodes("//p[contains(@style,'font-weight:bold')]");
foreach (var p in paragraphs)
{
    // remove bold font weight from style
    var style = Regex.Replace(p.Attributes["style"].Value, "font-weight:bold;?", "");        
    p.SetAttributeValue("style", style); // assign new style
    // wrap content of paragraph into b tag
    var b = HtmlNode.CreateNode("<b>");
    b.InnerHtml = p.InnerHtml;
    p.ChildNodes.Clear();
    p.AppendChild(b);
}

Если хотите, обернуть содержимое абзаца можно в одну строку:

p.InnerHtml = HtmlNode.CreateNode("<b>" + p.InnerHtml + "</b>").OuterHtml;
person Sergey Berezovskiy    schedule 23.09.2013
comment
@ user2729272 добро пожаловать :) Я добавил однострочную инструкцию для переноса содержимого абзаца в тег b. Я думаю, он менее читабельный, но более компактный - person Sergey Berezovskiy; 23.09.2013