If so you can download any of the below versions for testing. The product will function as normal except for an evaluation limitation. At the time of purchase we provide a license file via email that will allow the product to work in its full capacity. If you would also like an evaluation license to test without any restrictions for 30 days, please follow the directions provided here.
If you experience errors, when you try to download a file, make sure your network policies (enforced by your company or ISP) allow downloading ZIP and/or MSI files.

安装
该软件包在PyPI可用,可以通过执行以下命令通过pip安装:
pip install groupdocs-parser-cloud

要求
依赖关系
SDK自动安装以下软件包:
| Package | Constraint |
|---|
| urllib3 | >= 1.15 |
| six | >= 1.10 |
| certifi | — |
| python-dateutil | — |
快速入门
获取您的 API 凭证
要使用GroupDocs.Parser Cloud,请在GroupDocs.Cloud仪表板注册并获取您的Client ID和Client Secret。
初始化API
使用以下代码开始使用GroupDocs.Parser Cloud SDK for Python:
import groupdocs_parser_cloud
# Get your ClientId and ClientSecret at https://dashboard.groupdocs.cloud
client_id = "YourClientId"
client_secret = "YourClientSecret"
# Create API configuration
configuration = groupdocs_parser_cloud.Configuration(client_id, client_secret)
configuration.api_base_url = "https://api.groupdocs.cloud"
# Create instance of the Parse API
parse_api = groupdocs_parser_cloud.ParseApi.from_config(configuration)
从文档中提取文本
初始化后,使用此基本示例从云存储中的文档中提取文本:
import groupdocs_parser_cloud
client_id = "YourClientId"
client_secret = "YourClientSecret"
parse_api = groupdocs_parser_cloud.ParseApi.from_keys(client_id, client_secret)
options = groupdocs_parser_cloud.TextOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "email/eml/embedded-image-and-attachment.eml"
request = groupdocs_parser_cloud.TextRequest(options)
result = parse_api.text(request)
print("Text: " + result.text)
通过本快速入门指南,您已准备好开始在 Python 应用程序中使用 GroupDocs.Parser Cloud 解析文档。欲了解更多详情,请访问文档。
获取支持的文件格式
通过 Parser API 检索可用的受支持文件格式的完整列表。
import groupdocs_parser_cloud
info_api = groupdocs_parser_cloud.InfoApi.from_keys("YourClientId", "YourClientSecret")
result = info_api.get_supported_file_formats()
for fmt in result.formats:
print(fmt.file_format)
通过模板解析文档
使用存储在云存储中的用户定义模板解析文档,以提取结构化字段和表格。
import groupdocs_parser_cloud
parse_api = groupdocs_parser_cloud.ParseApi.from_keys("YourClientId", "YourClientSecret")
options = groupdocs_parser_cloud.ParseOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "words-processing/docx/companies.docx"
options.template_path = "templates/companies.json"
request = groupdocs_parser_cloud.ParseRequest(options)
result = parse_api.parse(request)
for data in result.fields_data:
if data.page_area.page_text_area is not None:
print("Field name: " + data.name + ". Text: " + data.page_area.page_text_area.text)
if data.page_area.page_table_area is not None:
print("Table name: " + data.name)
for cell in data.page_area.page_table_area.page_table_area_cells:
print("Row " + str(cell.row_index) + " column " + str(cell.column_index) + ": " + cell.page_area.page_text_area.text)
从文档中提取图像
从文档中提取所有嵌入图像并检索其云存储路径和下载 URL。
import groupdocs_parser_cloud
parse_api = groupdocs_parser_cloud.ParseApi.from_keys("YourClientId", "YourClientSecret")
options = groupdocs_parser_cloud.ImagesOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "slides/three-slides.pptx"
request = groupdocs_parser_cloud.ImagesRequest(options)
result = parse_api.images(request)
for image in result.images:
print("Image path: " + image.path + ". Download url: " + image.download_url)
print("Format: " + image.file_format + ". Page index: " + str(image.page_index))
获取文档信息
检索有关文档的元数据,例如页数和文件属性。
import groupdocs_parser_cloud
info_api = groupdocs_parser_cloud.InfoApi.from_keys("YourClientId", "YourClientSecret")
options = groupdocs_parser_cloud.InfoOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "words-processing/docx/password-protected.docx"
options.file_info.password = "password"
request = groupdocs_parser_cloud.GetInfoRequest(options)
result = info_api.get_info(request)
print("Page count: " + str(result.page_count))
获取集装箱物品信息
列出容器文件(例如 ZIP 存档或邮件存储)中的项目。
import groupdocs_parser_cloud
info_api = groupdocs_parser_cloud.InfoApi.from_keys("YourClientId", "YourClientSecret")
options = groupdocs_parser_cloud.ContainerOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "containers/archive/zip.zip"
request = groupdocs_parser_cloud.ContainerRequest(options)
result = info_api.container(request)
for item in result.container_items:
print("Name: " + item.name + ". FilePath: " + item.file_path)
GitHub 上的示例项目
GroupDocs.Parser Cloud Python 示例 存储库包含可立即运行的示例,涵盖:
| Category | Examples |
|---|
| Info Operations | Supported file formats, document information, container items information |
| Parse Operations — Extract Text | Extract text from whole document, formatted text, text by page range, text from container |
| Parse Operations — Extract Images | Extract images from whole document, images by page range, images from container |
| Parse Operations — Parse by Template | Parse by template in user storage, template defined as object, parse document inside container |
| Template Operations | Create or update template, get template, delete template |
如何运行示例
- 克隆或下载示例存储库
- 编辑
RunExamples.py并设置app_sid和app_key
3.进入Examples目录
4.运行pip install groupdocs-parser-cloud -U
5.执行python RunExamples.py
欲了解更多详情,请访问入门。

标签
Document Data Extraction | Python Cloud API | GroupDocs.Parser Cloud | REST API | Text Extraction | Image Extraction | Template Parsing | Data Parsing | Document Information | Container Files | Cloud Storage Integration | File Operations | Folder Operations | Secure API Access | Document Parsing | Metadata Extraction | PDF Parsing | ZIP Files | PST/OST Files | Cross-platform API | Document Processing | Data Extraction API