解析HTML是一项自动化工作,由(所谓的)HTML解析器执行。它们有两个主要目的:
- HTML遍历:为程序员提供一个接口,来轻松地访问和修改“HTML代码”。典型例子:DOM解析器。
- HTML清理:修正有语法错误的HTML,改善结果标记的布局和缩进样式。典型例子:HTML Tidy。
: * (有重要更新的)最新版本日期。
: * 规范(生成标准兼容的网页,减少垃圾信息,等)和清理*(剥离过剩的表达标签,移除XSS代码,等)HTML代码。
: *** 将HTML4.X升级到XHTML或HTML5,将废弃的标签(如CENTER)转换为有效的标签(如带有style="text-align:center;"的DIV)。
参考资料
评论 (0)