博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
PHP - 如何解析HTML文件
阅读量:5901 次
发布时间:2019-06-19

本文共 429 字,大约阅读时间需要 1 分钟。

有一个开源的PHP库“PHP Simple HTML DOM Parser”,其官方网址为http://simplehtmldom.sourceforge.net/,它可以将HTML文件解析为DOM模型,并且其查找DOM对象的语法类似jQuery,使用很方便,具体用法到官网看帮助。

对于中文网页,如果编码不是UTF-8的,则需要采用如下代码转换:

$info = file_get_contents("http://www.siluke.com/0/78/78773/");

$info = iconv("gbk", "utf-8//IGNORE", $info);

$dom = str_get_html($info);

就是先用
file_get_contents()得到页面内容,再用iconv()转换编码,最后用str_get_html()生成DOM
树。

转载于:https://my.oschina.net/tywali/blog/682179

你可能感兴趣的文章
poj 2234 Matches Game
查看>>
sax方式解析XML学习笔记
查看>>
Springboot配置(上)
查看>>
java--Eclipse for mac 代码提示(代码助手,代码联想)快捷键修改
查看>>
Jdom的简单操作
查看>>
left join on/right join on/inner join on/full join on连接
查看>>
Codeforces 582B Once Again
查看>>
template.helper 多参数
查看>>
RadioButton布局图片+文字 实现tabhost效果
查看>>
access中设置不等于
查看>>
hdu 1221 Rectangle and Circle
查看>>
Android 四大组件之四(ContentProvider)
查看>>
Android 四大组件之一(Activity)
查看>>
扫描(一)
查看>>
PIE SDK矢量数据的读取
查看>>
两种方式分别改变alertdialog的宽和高
查看>>
TextView-setCompondDrawables用法
查看>>
Centos7安装rabbitmq server 3.6.0
查看>>
关于eclipse的ADT(插件)对xml的android:text属性检查修改
查看>>
iostat命令学习
查看>>