
Aspose.HTML 云 SDK for Python
Python HTML SDK 用于创建、编辑和转换 HTML 文档
一个 Python HTML SDK,使程序员能够通过 Python REST API 开发和管理基于云的 HTML 生成、解析、操作和转换应用程序。
什么是 Aspose.HTML Cloud SDK for Python?
在快速发展的软件开发领域,利用强大的工具和库可以显著简化创建、编辑和处理各种文档的过程。Aspose.HTML Cloud SDK for Python 正是这样一种工具,它使软件开发人员和工程师能够轻松处理 HTML 文档,从而专注于打造卓越的应用程序,而无需处理繁琐的 HTML 细节。
Aspose.HTML Cloud SDK for Python 是一套全面的工具和库,使软件开发人员能够将 HTML 处理功能集成到他们的 Python 应用程序中。该 SDK 提供了广泛的功能,例如解析、渲染、编辑、打印以及将 HTML 文档转换为各种格式,使其成为需要精确处理 HTML 内容的项目的关键资产。它提供直观的界面,抽象了 HTML 处理的复杂性,让软件开发人员能够专注于构建自己的应用程序。
Aspose.HTML Cloud SDK for Python 能够无缝集成其他流行的库和框架,使其成为各种开发场景的理想选择。通过简化解析、渲染和转换等复杂任务,该 SDK 赋能开发者创建更健壮、功能更丰富的应用程序,最终提升终端用户体验。其全面的功能集、易用性和强大的功能使其在从简单的 HTML 解析到复杂的内容管理等任务中都是出色的选择。将此 SDK 集成到您的 Python 应用程序中,您可以简化与 HTML 相关的流程并提升项目效率。
Aspose.HTML Cloud SDK for Python 入门指南
推荐通过 PyPi 安装 Aspose.HTML Cloud SDK for Python。您可以在 Maven 项目中使用简单的配置直接使用该 API。
通过 PyPi 安装 Aspose.HTML Cloud SDK for Python
pip install asposehtmlcloud您可以直接从 Aspose.HTML Cloud SDK for Python 产品页面下载库。
HTML 转图片/PDF 转换
将 HTML 转换为 PDF 或图像格式是处理文档生成的应用程序中的常见需求。Aspose.HTML Cloud SDK for Python 已全面支持将 HTML 文档转换为多种主流文件格式。该 SDK 简化了此转换过程,使软件开发人员能够从 HTML 内容生成高质量的 PDF、XPS、DOCX、MHTML,以及 JPEG、BMP、PNG、TIFF、GIF 等图像。SDK 支持在 Python 应用程序中转换整个文档以及在线 HTML 页面。以下示例演示了软件开发人员如何使用 Python 代码将存储中的 HTML 文档转换为 PDF。
如何通过 Python API 将存储中的 HTML 文档转换为 PDF?
name = "test1.html"
result_name = "putHtmlToPdf.pdf"
folder = "HtmlTestDoc"
out_path = folder + "/" + result_name
try:
# Convert document to pdf in storage
self.api.put_convert_document_to_pdf(
name, out_path=out_path, width=800, height=1000, left_margin=50, right_margin=100,
top_margin=150, bottom_margin=200, folder=folder, storage="")
# Download result
res = Helper.download_file(out_path)
save_file = Helper.dst + result_name
Helper.move_file(res, save_file)
except ApiException as ex:
print("Exception")
print("Info: " + str(ex))
raise ex
解析并渲染 HTML 内容
Aspose.HTML Cloud SDK for Python 让软件开发人员只需几行 Python 代码即可加载和解析现有的 HTML 文档。由于标记语言的复杂性,解析 HTML 文档可能是一项艰巨的任务。该 SDK 抽象了 HTML 解析的复杂性,使软件开发人员能够轻松地从 HTML 文档中提取有意义的数据。以下示例展示了软件开发人员如何在 Python 应用程序中获取 HTML 文档中的所有图像。
如何使用 Python API 获取所有 HTML 文档图像?
name = "test3.html.zip"
try:
# Upload file to storage
res = Helper.upload_file(name)
self.assertTrue(len(res.uploaded) == 1)
self.assertTrue(len(res.errors) == 0)
# Get images from document on remote storage
res = self.api.get_document_images(name=name, storage="", folder=Helper.folder)
self.assertTrue(isinstance(res, str), "Error get images from document")
# Move to test folder
Helper.move_file(str(res), Helper.dst)
except ApiException as ex:
print("Exception")
print("Info: " + str(ex))
raise ex
通过 Python API 操作 HTML 文件
Aspose.HTML Cloud SDK for Python 是一款对需要在应用程序中实现 HTML 操作功能的软件专业人士非常有用的工具。它使软件开发人员能够以编程方式操作 HTML 文档。开发人员可以以编程方式修改 HTML 内容、插入或删除元素、更新属性并执行各种转换,这使其成为内容管理应用的理想解决方案。
网页抓取与 XPath 导航支持
在 HTML 文档中导航和操作特定元素通常需要使用 XPath 表达式。Aspose.HTML Cloud SDK for Python 已加入对 XPath 导航的支持,使得定位和操作文档结构中的元素更加简便。对于涉及从网站提取数据的项目,该 SDK 可用于网页抓取任务。您可以解析并提取 HTML 页面中的数据,这使其成为收集网络信息的宝贵工具。
如何通过 Python API 获取匹配指定 XPath 查询的 HTML 片段列表?
# For complete examples and data files, please go to https://github.com/aspose-html-cloud/aspose-html-cloud-python
name = "test2.html.zip"
x_path = ".//p"
out_format = "plain"
try:
# Upload file to storage
res = Helper.upload_file(name)
self.assertTrue(len(res.uploaded) == 1)
self.assertTrue(len(res.errors) == 0)
# Get fragment document from remote storage
res = self.api.get_document_fragment_by_x_path(name=name, x_path=x_path, out_format=out_format,
storage="", folder=Helper.folder)
self.assertTrue(isinstance(res, str), "Error get fragment document from remote storage")
# Move to test folder
Helper.move_file(str(res), Helper.dst)
except ApiException as ex:
print("Exception")
print("Info: " + str(ex))
raise ex
