Computer >> Máy Tính >  >> Lập trình >> Python

Cách sử dụng Boto3 để phân trang thông qua tất cả các trình kích hoạt có trong AWS Glue

Tuyên bố sự cố: Sử dụng boto3 thư viện bằng Python để phân trang thông qua tất cả các trình kích hoạt từ Danh mục dữ liệu AWS Glue được tạo trong tài khoản của bạn

Phương pháp tiếp cận / Thuật toán để giải quyết vấn đề này

  • Bước 1: Nhập boto3 botocore các ngoại lệ để xử lý các ngoại lệ.

  • Bước 2: max_items , page_size started_token là các tham số tùy chọn cho chức năng này

    • max_items biểu thị tổng số bản ghi cần trả về. Nếu số lượng bản ghi có sẵn> max_items , sau đó là NextToken sẽ được cung cấp trong câu trả lời để tiếp tục phân trang.

    • page_size biểu thị kích thước của mỗi trang.

    • started_token giúp phân trang và nó sử dụng NextToken từ một phản hồi trước đó.

  • Bước 3: Tạo phiên AWS bằng boto3 lib . Đảm bảo rằng region_name được đề cập trong hồ sơ mặc định. Nếu nó không được đề cập, thì hãy chuyển region_name một cách rõ ràng trong khi tạo phiên.

  • Bước 4: Tạo ứng dụng AWS cho keo dán.

  • Bước 5: Tạo bộ phân trang đối tượng chứa thông tin chi tiết về tất cả các trình kích hoạt bằng get_triggers

  • Bước 5: Gọi phân trang và chuyển max_items , page_size started_token dưới dạng PaginationConfig tham số

  • Bước 6: Nó trả về số lượng bản ghi dựa trên max_size page_size .

  • Bước 7: Xử lý ngoại lệ chung nếu có sự cố trong khi phân trang.

Mã mẫu

Sử dụng mã sau để phân trang thông qua tất cả các trình kích hoạt được tạo trong tài khoản người dùng -

import boto3
from botocore.exceptions import ClientError

def paginate_through_triggers(max_items=None:int,page_size=None:int, starting_token=None:string):
   session = boto3.session.Session()
   glue_client = session.client('glue')
   try:
   paginator = glue_client.get_paginator('get_triggers')
      response = paginator.paginate(PaginationConfig={
         'MaxItems':max_items,
         'PageSize':page_size,
         'StartingToken':starting_token}
       )
   return response
   except ClientError as e:
      raise Exception("boto3 client error in paginate_through_triggers: " + e.__str__())
   except Exception as e:
      raise Exception("Unexpected error in paginate_through_triggers: " + e.__str__())

page_itr = paginate_through_tables("test_db",2,5)
for page in page_itr:
print(page['Triggers']

Đầu ra

[{'Name': 'file-passed', 'WorkflowName': 'data-tx', 'Type': 'CONDITIONAL', 'State': 'ACTIVATED', 'Actions': [{'JobName': 'data-event'}], 'Predicate': {'Logical': 'ANY', 'Conditions': [{'LogicalOperator': 'EQUALS', 'JobName': 'data-worker', 'State': 'SUCCEEDED'}]}},
{'Name': 'file-passed-to-acc', 'WorkflowName': 'tick-data', 'Type': 'CONDITIONAL', 'State': 'ACTIVATED', 'Actions': [{'JobName': 'tick-data'}], 'Predicate': {'Logical': 'ANY', 'Conditions': [{'LogicalOperator': 'EQUALS', 'JobName': 'tick-data', 'State': 'SUCCEEDED'}]}}