aws / aws/amazon-sagemaker-examples

Autogluon model endpoint creation using 'AutoGluonRealtimePredictor'

Open
#3,949 1 comment 0 reactions 0 assignees View on GitHub
Dominant language
Jupyter Notebook
Stars
11k
Forks
7k
Avg merge
8h 29m
Merged PRs (30d)
8

Description

Creating endpoint to predict probabilities

code -
model = AutoGluonNonRepackInferenceModel(
model_data=r's3://s3-ampf-us-east-1-aim-gco-expl-c3/SRT_Models/SP/Version_3/ag-20221101_101338.tar.gz',
role=role,
region=region,
framework_version="0.5.2",
py_version="py38",
instance_type="ml.m5.large",
entry_point="tabular_serve.py",
sagemaker_session = sagemaker_session,
source_dir="Scripts"
)
model.deploy(initial_instance_count=1, serializer=CSVSerializer(), instance_type="ml.m5.large")
predictor = AutoGluonRealtimePredictor(model.endpoint_name)
df_test = pd.read_csv("path/test.csv")
preds = predictor.predict(df_test)

error -
ModelError Traceback (most recent call last)
in
1 # AutoGluonRealtimePrediction on test data without column names
2 df_test = pd.read_csv("path/test.csv")
----> 3 preds = predictor.predict(df_test)

/opt/conda/lib/python3.7/site-packages/sagemaker/predictor.py in predict(self, data, initial_args, target_model, target_variant, inference_id)
159 data, initial_args, target_model, target_variant, inference_id
160 )
--> 161 response = self.sagemaker_session.sagemaker_runtime_client.invoke_endpoint(**request_args)
162 return self._handle_response(response)
163

/opt/conda/lib/python3.7/site-packages/botocore/client.py in _api_call(self, *args, **kwargs)
528 )
529 # The "self" in this scope is referring to the BaseClient.
--> 530 return self._make_api_call(operation_name, kwargs)
531
532 _api_call.__name__ = str(py_operation_name)

/opt/conda/lib/python3.7/site-packages/botocore/client.py in _make_api_call(self, operation_name, api_params)
958 error_code = parsed_response.get("Error", {}).get("Code")
959 error_class = self.exceptions.from_code(error_code)
--> 960 raise error_class(parsed_response, operation_name)
961 else:
962 return parsed_response

ModelError: An error occurred (ModelError) when calling the InvokeEndpoint operation: Received server error (503) from primary with message "{
"code": 503,
"type": "InternalServerException",
"message": "Prediction failed"
}

Contributor guide

Open the contributing guide

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.