网页内容解析库

    一组网页HTML内容解析库
¥1000.0
开发者:   张明东
更新时间:   2026/08/25 14:19
当前插件版本:   1.2.8
jar包时间要求:   2018/07/31

登录后可下载

网页内容解析库 - FineReport帮助文档 - 全面的报表使用教程和学习资料 (fanruan.com)

函数名称: FRUrlHtmlParser
功能: 通过指定网址获取数据。
参数说明:

参数1:网址文本。
参数2:选择类型文本,值为"id","tag","class"。
参数3:选择类型值。
示例:
FRUrlHtmlParser("https://www.jianshu.com/","id","sign_up")


函数名称: FRCleanNoSafeTag
功能: 消除不受信任的HTML (防止XSS攻击)。
参数说明:

参数1:Html文本。
参数2:清理类型:
none:会清除所有HTML标签,仅保留文本节点。
simpleText:I仅会保留b, em, i, strong, u 标签,除此之外的所有HTML标签都会被清除。
basic:会保留 a, b, blockquote, br, cite, code, dd, dl, dt, em, i, li, ol, p, pre, q, small, span, strike, strong, sub, sup, u, ul 和其适当的属性标签,除此之外的所有HTML标签都会被清除,且该参数不允许出现图片(img tag)。另外该参数中允许出现的超链接中可以允许其指定http, https, ftp, mailto 且在超链接中强制追加rel=nofollow属性。
basicWithImages:在保留basic()中允许出现的标签的同时也允许出现图片(img tag)和img的相关适当属性,且其src允许其指定 http 或 https。
relaxed:仅会保留 a, b, blockquote, br, caption, cite, code, col, colgroup, dd, div, dl, dt, em, h1, h2, h3, h4, h5, h6, i, img, li, ol, p, pre, q, small, span, strike, strong, sub, sup, table, tbody, td, tfoot, th, thead, tr, u, ul 标签,除此之外的所有HTML标签都会被清除,且在超链接中不会强制追加rel=nofollow属性。
示例:
FRCleanNoSafeTag("<p><a href='http://baidu.com/' οnclick='stealCookies()'>Link</a></p>","basic")


函数名称: FRGetDocFromURL
功能: 从URL加载为文档元素,作为其它函数的参数。
参数说明:

参数1:网址文本。
示例:
FRGetTextContext(FRGetElementById(FRGetDocFromURL("https://www.jianshu.com/"),"sign_up"))


函数名称: FRGetDocFromFile
功能: 从文件加载为文档元素,作为其它函数的参数。
参数说明:

参数1:文件绝对路径文本。
示例:
FRGetOutHTMLContext(FRGetElementBySelector(FRGetDocFromFile("f:htmlStr.txt"),"p",0))


函数名称: FRGetDocFromString
功能: 从字符串加载为文档元素,作为其它函数的参数。
参数说明:

参数1:包含html文本字符串。
示例:
FRGetOutHTMLContext(FRGetElementBySelector(FRGetDocFromString(""),"p",0))


函数名称: FRGetDocFromPostUrl
功能: 向URL 网址Post(网址支持Post)数据并加载为文档元素,作为其它函数的参数。
参数说明:

参数1:网址文本。
参数2:向参数1网址Post的数据,以JSON格式输入,如:"{'username':'admin','password':'111111'}"。
示例:
FRGetTextContext(FRGetElementByTag(FRGetDocFromPostUrl("http://localhost:999/magicflu/rlogin","{'j_username':'admin','j_password':'magicfluapp'}"),"body",0))


函数名称: FRGetElementById
功能: 通过元素ID获取指定元素。
参数说明:

参数1:文档对象(FRGetDoc函数的返回结果)。
参数2:元素ID文本。
示例:
FRGetTextContext(FRGetElementById(FRGetDocFromURL("https://www.jianshu.com/"),"sign_up"))


函数名称: FRGetElementByTag
功能: 通过元素Tag获取指定元素。
参数说明:

参数1:文档对象(FRGetDoc函数的返回结果)。
参数2:元素Tag文本。
参数3:返回元素的下标整数(大于等于0)。
示例:
FRGetTextContext(FRGetElementByTag(FRGetDocFromURL("https://www.jianshu.com/"),"a",8))


函数名称: FRGetElementByClass
功能: 通过元素Class获取指定元素。
参数说明:

参数1:文档对象(FRGetDoc函数的返回结果)。
参数2:元素Class文本。
参数3:大于或等于0的数字,如果通过Class获取元素有多个,这个参数指定其中一个元素。
示例:
FRGetTextContext(FRGetElementByClass(FRGetDocFromURL("https://www.jianshu.com/"),"note-list",0))


函数名称: FRGetElementBySelector
功能: 通过元素类似于CSS或jQuery的语法来查找和操作元素。
参数说明:

参数1:文档对象(FRGetDoc函数的返回结果)。
参数2:元素CSS或jQuery的语法选择器文本。具体参数见:https://jsoup.org/apidocs/org/jsoup/select/Selector.html
参数3:大于或等于0的数字,如果通过CSS或jQuery的语法获取元素有多个,这个参数指定其中一个元素。
示例:
FRGetTextContext(FRGetElementBySelector(FRGetDocFromURL("https://www.jianshu.com/"),".menu-text",0))


函数名称: FRGetTextContext
功能: 获取文本内容。
参数说明:

参数1:元素对象(FRGetElement函数的返回结果)。
示例:
FRGetTextContext(FRGetElementById(FRGetDocFromURL("https://www.jianshu.com/"),"sign_up"))


函数名称: FRGetHTMLContext
功能: 获取HTML内容。
参数说明:

参数1:元素对象(FRGetElement函数的返回结果)。
示例:
FRGetHTMLContext(FRGetElementBySelector(FRGetDocFromURL("https://www.jianshu.com/"),".menu-text",0))


函数名称: FRGetOutHTMLContext
功能: 获取外部HTML内容。
参数说明:

参数1:元素对象(FRGetElement函数的返回结果)。
示例:
FRGetOutHTMLContext(FRGetElementBySelector(FRGetDocFromURL("https://www.jianshu.com/"),".menu-text",0))


函数名称: FRGetAttribeContext
功能: 获取一个属性的值。
参数说明:

参数1:元素对象(FRGetElement函数的返回结果)。
参数2:指定元素属性文本。
示例:
FRGetAttribeContext(FRGetElementById(FRGetDocFromURL("https://www.jianshu.com/"), "sign_up"), "href&

[2021-3-6]初始化插件。
[2021-9-9]增加env-version 11支持 。
[2022-12-29]修改 POB-2611。
[2023-4-19]修改 POB-2982,升级jar包。
[2023-4-23]POB-3005,修复网站不能连续打开时,提示信息不清晰bug。
[2026-6-5]POB-5045,产品安全要求,增加打包签名。
[2026-7-21]1.2.6;第三方组件升级,fastjson-1.2.83.jar,需要升级到2.0.62。
[2026-8-8]1.2.7;第三方组件升级,fastjson,需要升级到2.0.64。
[2026-8-21]1.2.8;第三方组件升级,jsoup,需要升级到1.23.1。

    您的评价

        差劲           优秀