Navegue pelos nossos produtos

If so you can download any of the below versions for testing. The product will function as normal except for an evaluation limitation. At the time of purchase we provide a license file via email that will allow the product to work in its full capacity. If you would also like an evaluation license to test without any restrictions for 30 days, please follow the directions provided here.


Product Docs Swagger Examples Blog Support Dashboard

Instalação

O pacote é disponível em PyPI e pode ser instalado via pip executando o seguinte comando:

pip install groupdocs-parser-cloud

PyPI - Version PyPI - Downloads Python-GroupDocsCloud


Requisitos

Dependências

PacoteRestrição
urllib3>= 1,15
six>= 1,10
certifi
python-dateutil

O SDK instala automaticamente os seguintes pacotes:

Início rápido

Obtenha suas credenciais API

Para usar GroupDocs.Parser Cloud, cadastre-se em GroupDocs.Cloud Dashboard e obtenha seu ID do cliente e Segredo do cliente.

Inicialize o API

Use o código a seguir para começar a usar o GroupDocs.Parser Cloud SDK para Python:

import groupdocs_parser_cloud

# Get your ClientId and ClientSecret at https://dashboard.groupdocs.cloud
client_id = "YourClientId"
client_secret = "YourClientSecret"

# Create API configuration
configuration = groupdocs_parser_cloud.Configuration(client_id, client_secret)
configuration.api_base_url = "https://api.groupdocs.cloud"

# Create instance of the Parse API
parse_api = groupdocs_parser_cloud.ParseApi.from_config(configuration)

Extraia texto de um documento

Depois de inicializado, use este exemplo básico para extrair texto de um documento no armazenamento em nuvem:

import groupdocs_parser_cloud

client_id = "YourClientId"
client_secret = "YourClientSecret"

parse_api = groupdocs_parser_cloud.ParseApi.from_keys(client_id, client_secret)

options = groupdocs_parser_cloud.TextOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "email/eml/embedded-image-and-attachment.eml"

request = groupdocs_parser_cloud.TextRequest(options)
result = parse_api.text(request)

print("Text: " + result.text)

Com este guia de início rápido, você está pronto para começar a analisar documentos usando GroupDocs.Parser Cloud em seus aplicativos Python. Para mais detalhes, visite documentation.

Obtenha formatos de arquivo suportados

Recupere a lista completa de formatos de arquivo suportados disponíveis através do Parser API.

import groupdocs_parser_cloud

info_api = groupdocs_parser_cloud.InfoApi.from_keys("YourClientId", "YourClientSecret")

result = info_api.get_supported_file_formats()

for fmt in result.formats:
    print(fmt.file_format)

Analisar documento por modelo

Analise um documento usando um modelo definido pelo usuário armazenado em armazenamento em nuvem para extrair campos e tabelas estruturados.

import groupdocs_parser_cloud

parse_api = groupdocs_parser_cloud.ParseApi.from_keys("YourClientId", "YourClientSecret")

options = groupdocs_parser_cloud.ParseOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "words-processing/docx/companies.docx"
options.template_path = "templates/companies.json"

request = groupdocs_parser_cloud.ParseRequest(options)
result = parse_api.parse(request)

for data in result.fields_data:
    if data.page_area.page_text_area is not None:
        print("Field name: " + data.name + ". Text: " + data.page_area.page_text_area.text)

    if data.page_area.page_table_area is not None:
        print("Table name: " + data.name)
        for cell in data.page_area.page_table_area.page_table_area_cells:
            print("Row " + str(cell.row_index) + " column " + str(cell.column_index) + ": " + cell.page_area.page_text_area.text)

Extraia imagens de um documento

Extraia todas as imagens incorporadas de um documento e recupere seus caminhos de armazenamento em nuvem e URLs de download.

import groupdocs_parser_cloud

parse_api = groupdocs_parser_cloud.ParseApi.from_keys("YourClientId", "YourClientSecret")

options = groupdocs_parser_cloud.ImagesOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "slides/three-slides.pptx"

request = groupdocs_parser_cloud.ImagesRequest(options)
result = parse_api.images(request)

for image in result.images:
    print("Image path: " + image.path + ". Download url: " + image.download_url)
    print("Format: " + image.file_format + ". Page index: " + str(image.page_index))

Obtenha informações do documento

Recuperar metadados sobre um documento, como contagem de páginas e propriedades do arquivo.

import groupdocs_parser_cloud

info_api = groupdocs_parser_cloud.InfoApi.from_keys("YourClientId", "YourClientSecret")

options = groupdocs_parser_cloud.InfoOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "words-processing/docx/password-protected.docx"
options.file_info.password = "password"

request = groupdocs_parser_cloud.GetInfoRequest(options)
result = info_api.get_info(request)

print("Page count: " + str(result.page_count))

Obtenha informações sobre itens de contêiner

Liste itens em arquivos contêineres, como arquivos ZIP ou armazenamentos de correio.

import groupdocs_parser_cloud

info_api = groupdocs_parser_cloud.InfoApi.from_keys("YourClientId", "YourClientSecret")

options = groupdocs_parser_cloud.ContainerOptions()
options.file_info = groupdocs_parser_cloud.FileInfo()
options.file_info.file_path = "containers/archive/zip.zip"

request = groupdocs_parser_cloud.ContainerRequest(options)
result = info_api.container(request)

for item in result.container_items:
    print("Name: " + item.name + ". FilePath: " + item.file_path)

Exemplos de projetos em GitHub

O repositório GroupDocs.Parser Cloud Python Samples inclui exemplos prontos para execução que abrangem:

CategoriaExemplos
Operações de informaçõesFormatos de arquivo suportados, informações de documentos, informações de itens de contêiner
Operações de análise — Extrair textoExtraia texto de todo o documento, texto formatado, texto por intervalo de páginas, texto do contêiner
Operações de análise — Extrair imagensExtraia imagens de todo o documento, imagens por intervalo de páginas, imagens do contêiner
Operações de análise — Análise por modeloAnalisar por modelo no armazenamento do usuário, modelo definido como objeto, analisar documento dentro do contêiner
Operações de modeloCriar ou atualizar modelo, obter modelo, excluir modelo

Como executar os exemplos

  1. Clone ou baixe o samples repository
  2. Edite RunExamples.py e defina seu app_sid e app_key
  3. Vá para o diretório Examples
  4. Execute pip install groupdocs-parser-cloud -U
  5. Execute python RunExamples.py Para mais detalhes, visite Getting Started.

Product Docs Swagger Examples Blog Support Dashboard


Tags

Document Data Extraction | Python Cloud API | GroupDocs.Parser Cloud | REST API | Text Extraction | Image Extraction | Template Parsing | Data Parsing | Document Information | Container Files | Cloud Storage Integration | File Operations | Folder Operations | Secure API Access | Document Parsing | Metadata Extraction | PDF Parsing | ZIP Files | PST/OST Files | Cross-platform API | Document Processing | Data Extraction API



 Português