如何从标签中检索数据<content:encoded>使用来自 RSS 提要的 CDATA 和用于 android 的 Jsoup？</content:encoded>

Question

我想使用 jsoup 从 RSS 提要中检索数据。 我可以使用所有标签，但是当有 content:encoded 标签时我不能这样做。 请任何人帮助我如何从内容获取数据：编码标签。 我的提要 URL 是https://sambad.in/feed/我的代码也是 Document doc = Jsoup.parse(String.valueOf(response)); 元素 itemElements = doc.select("item");

            for (int i = 0; i < itemElements.size(); i++) {

                Element item = itemElements.get(i);
                String title = item.child(0).text();
                String link=item.child(1).text();
                String imgUrl=extractImageUrl(item.select("description").text());
                String description = extractPostText(item.select("description").text())+"From Sambad: By Pin2";
                String fullnews=extractPostText(item.children().select("http://purl.org/rss/1.0/modules/content/encoded").text());

Answer 1

要使用的选择器将是content|encoded 。 要指定命名空间标记，请将:替换为| . 有关更多示例，请参阅jsoup 选择器文档。

这是Try Jsoup上的一个活生生的例子。

有几点需要注意：

对于 RSS，您应该使用XML 解析器而不是（默认）解析器。 通常，如果您使用Jsoup.connect(url)加载内容，这会自动发生，因为它会根据内容类型设置解析器。 但是您正在绕过它（通过提供字符串输入），因此您需要手动指定它。
content|encoded选择器的结果将是一组包含带有 HTML 标记的文本的元素（未解析的 HTML 元素）。 这是因为 RSS 中的内容是 HTML 编码（转义）的。 如果您希望它解析为 HTML，您接下来应该对文本使用Jsoup.parseBodyFragment(String)方法。

如何从标签中检索数据<content:encoded>使用来自 RSS 提要的 CDATA 和用于 android 的 Jsoup？</content:encoded>

问题描述

1 个解决方案

解决方案1
0 2021-01-07 12:14:17

如何从标签中检索数据<content:encoded>使用来自 RSS 提要的 CDATA 和用于 android 的 Jsoup？</content:encoded>

问题描述

1 个解决方案

解决方案1 0 2021-01-07 12:14:17

解决方案1
0 2021-01-07 12:14:17