RegisteredDataset

pydantic model openapi_client.models.registered_dataset.RegisteredDataset

Dataset metadata. In list responses (GET /datasets) only the fields in the projectionExpression are returned. In detail responses (GET /datasets/{id}) all stored fields plus computed fields (IsOwner, DatasetS3Path, ConnectionDetails, Schedules, etc.) are returned.

Fields:
field dataset_id: Optional[StrictStr] = None (alias 'DatasetId')

Unique dataset identifier (UUID).

field dataset_name: Optional[StrictStr] = None (alias 'DatasetName')

Name of the dataset, unique within its domain.

field display_name: Optional[StrictStr] = None (alias 'DisplayName')

Human-readable display name. Defaults to DatasetName if not explicitly set.

field dataset_description: Optional[StrictStr] = None (alias 'DatasetDescription')

Free-text description of the dataset.

field data_classification: Optional[List[StrictStr]] = None (alias 'DataClassification')

Data classification labels.

field domain: Optional[StrictStr] = None (alias 'Domain')

Domain the dataset belongs to.

field domain_display_name: Optional[StrictStr] = None (alias 'DomainDisplayName')

Human-readable display name of the domain.

field partitioned: Optional[StrictStr] = None (alias 'Partitioned')

Whether the dataset table is partitioned.

field file_type: Optional[StrictStr] = None (alias 'FileType')

Source file format. May be absent for view datasets.

field target_location: Optional[StrictStr] = None (alias 'TargetLocation')

Storage backend (s3, s3athena, redshift, lf, dynamodb).

field keywords: Optional[List[StrictStr]] = None (alias 'Keywords')

Search keywords. May be absent or empty.

field dataset_schema: Optional[List[ColumnNameAndType]] = None (alias 'DatasetSchema')

Column definitions.

field table_update: Optional[StrictStr] = None (alias 'TableUpdate')

Data load mode (append, reload, full-refresh, etc.).

field data_metrics_collection_options: Optional[DataMetricsCollectionOptions] = None (alias 'DataMetricsCollectionOptions')

Metrics collection configuration.

field sync_to_s3_options: Optional[RegisteredDatasetSyncToS3Options] = None (alias 'SyncToS3Options')
field dwh_table_name: Optional[StrictStr] = None (alias 'DWHTableName')

Underlying Redshift/Athena table name.

field last_modified: Optional[StrictStr] = None (alias 'LastModified')

ISO timestamp of last modification.

field last_modified_by: Optional[StrictStr] = None (alias 'LastModifiedBy')

User ID who last modified the dataset.

field last_modified_time: Optional[StrictStr] = None (alias 'LastModifiedTime')

ISO timestamp of last modification.

field error_message: Optional[StrictStr] = None (alias 'ErrorMessage')

Error message from last failed operation.

field table_update_column: Optional[StrictStr] = None (alias 'TableUpdateColumn')

Column used for incremental updates.

field registration_status: Optional[StrictStr] = None (alias 'RegistrationStatus')

Dataset registration state (completed, in-progress, error, etc.).

field created_by: Optional[StrictStr] = None (alias 'CreatedBy')

User ID who created the dataset.

field creation_date: Optional[StrictStr] = None (alias 'CreationDate')

ISO timestamp of dataset creation.

field is_active: Optional[StrictStr] = None (alias 'IsActive')

Whether the dataset is active (“yes” or “no”).

field is_data_profiling_enabled: Optional[StrictBool] = None (alias 'IsDataProfilingEnabled')

Whether automatic data profiling is enabled.

field is_auto_ml_enabled: Optional[StrictBool] = None (alias 'IsAutoMLEnabled')

Whether AutoML model training is enabled.

field is_bda_extraction_enabled: Optional[StrictBool] = None (alias 'IsBDAExtractionEnabled')

Whether BDA extraction is enabled.

field access_type: Optional[StrictStr] = None (alias 'AccessType')

Caller’s access level on this dataset (owner, editor, or read-only).

field is_owner: Optional[StrictBool] = None (alias 'IsOwner')

Whether the caller is an owner.

field file_delimiter: Optional[StrictStr] = None (alias 'FileDelimiter')

Column delimiter for CSV/TSV files.

field skip_file_header: Optional[StrictBool] = None (alias 'SkipFileHeader')

Whether to skip the first row as header.

field connection_details: Optional[ConnectionDetails] = None (alias 'ConnectionDetails')

Redshift connection info. Detail response only; Redshift datasets only.

field schedules: Optional[List[RegisteredDatasetSchedulesInner]] = None (alias 'Schedules')

Schedules attached to this dataset.

field dataset_report: Optional[RegisteredDatasetDatasetReport] = None (alias 'DatasetReport')
field datasource_type: Optional[StrictStr] = None (alias 'DatasourceType')

Origin of data ingestion (api, jdbc, store, etc.).

field is_data_cleanup_enabled: Optional[StrictBool] = None (alias 'IsDataCleanupEnabled')

Whether automatic data cleanup is enabled.

field malware_detection_options: Optional[MalwareDetectionOptions] = None (alias 'MalwareDetectionOptions')

Malware scanning configuration.

field skip_lz_process: Optional[StrictBool] = None (alias 'SkipLZProcess')

Whether to skip Landing Zone processing.

field tenant_name: Optional[StrictStr] = None (alias 'TenantName')

Tenant name for multi-tenant deployments.

field are_ai_services_enabled: Optional[StrictBool] = None (alias 'AreAIServicesEnabled')

Whether AI services are enabled. S3 target only.

field dataset_s3_path: Optional[StrictStr] = None (alias 'DatasetS3Path')

Full S3 path for the dataset.

field dataset_status: Optional[StrictStr] = None (alias 'DatasetStatus')

Current dataset status.

field s3_athena_table_name: Optional[StrictStr] = None (alias 'S3AthenaTableName')

Athena table name.

field data_stewards: Optional[List[StrictStr]] = None (alias 'DataStewards')

User IDs designated as data stewards.

field data_category: Optional[StrictStr] = None (alias 'DataCategory')

Special data category (e.g. “spatial”).

field data_category_config: Optional[RegisteredDatasetDataCategoryConfig] = None (alias 'DataCategoryConfig')
field dataset_type: Optional[StrictStr] = None (alias 'DatasetType')

Dataset category (internal, external, view, materialized-view).

field resource_origin: Optional[StrictStr] = None (alias 'ResourceOrigin')

How the dataset was created (API, AWSConsole, etc.).

field raw_description: Optional[StrictStr] = None (alias 'RawDescription')

AI-generated description. DynamoDB list path only.

field read_only_file_level: Optional[StrictBool] = None (alias 'ReadOnlyFileLevel')

Whether caller has file-level read access. List response only when getFileLevelAccessDatasets=true.

field ser_de: Optional[StrictStr] = None (alias 'SerDe')

Serialization/deserialization library name.

field serde_properties: Optional[Dict[str, StrictStr]] = None (alias 'SerdeProperties')

User-configurable Glue SerDe parameters for s3athena/lf tables.

field table_properties: Optional[Dict[str, StrictStr]] = None (alias 'TableProperties')

Glue table parameters.

field data_source_id: Optional[StrictStr] = None (alias 'DataSourceId')

Deprecated alias for DatasourceId.

field datasource_id: Optional[StrictStr] = None (alias 'DatasourceId')

Datasource identifier if dataset is linked to a datasource.

field datasource_name: Optional[StrictStr] = None (alias 'DatasourceName')

Datasource display name.

field is_data_validation_enabled: Optional[StrictBool] = None (alias 'IsDataValidationEnabled')

Whether schema validation is enabled.

field is_translate_ai_results_enabled: Optional[StrictBool] = None (alias 'IsTranslateAIResultsEnabled')

Whether auto-translation of AI results is enabled.

field assume_role: Optional[StrictStr] = None (alias 'AssumeRole')

IAM role ARN for external dataset access.

field skip_trash: Optional[StrictBool] = None (alias 'SkipTrash')

Whether to permanently delete files. Detail response only; reload datasets only.

field target_table_prep_mode: Optional[StrictStr] = None (alias 'TargetTablePrepMode')

Target table prep mode (truncate or recreate). Detail response only; reload datasets only.

field dataset_key_options: Optional[RegisteredDatasetDatasetKeyOptions] = None (alias 'DatasetKeyOptions')
field column_table_constraints: Optional[Dict[str, Any]] = None (alias 'ColumnTableConstraints')

Column constraints. Redshift target.

field dynamodb_table_name: Optional[StrictStr] = None (alias 'DynamodbTableName')

DynamoDB table name.

field iceberg_table_options: Optional[RegisteredDatasetIcebergTableOptions] = None (alias 'IcebergTableOptions')
field hudi_table_options: Optional[RegisteredDatasetHudiTableOptions] = None (alias 'HudiTableOptions')
field database_host: Optional[StrictStr] = None (alias 'DatabaseHost')

Redshift database host.

field database_port: Optional[StrictStr] = None (alias 'DatabasePort')

Redshift database port.

field database_name: Optional[StrictStr] = None (alias 'DatabaseName')

Redshift database name.

field database_table_name: Optional[StrictStr] = None (alias 'DatabaseTableName')

Source database table name.

field jdbc_connection_string: Optional[StrictStr] = None (alias 'JdbcConnectionString')

JDBC connection string.

field odbc_connection_string: Optional[StrictStr] = None (alias 'OdbcConnectionString')

ODBC connection string.

field database_view_name: Optional[StrictStr] = None (alias 'DatabaseViewName')

Redshift view name.

field current_version: Optional[StrictStr] = None (alias 'CurrentVersion')

Current version ID for view datasets.

field sql_statement: Optional[StrictStr] = None (alias 'SqlStatement')

SQL query for view datasets.

field view_type: Optional[StrictStr] = None (alias 'ViewType')

Type of view (standard or materialized). View datasets only.

field view_versions: Optional[List[RegisteredDatasetViewVersionsInner]] = None (alias 'ViewVersions')

Version history for view datasets.

field is_delta_lake_table: Optional[StrictBool] = None (alias 'IsDeltaLakeTable')

Whether this dataset uses Delta Lake table format. LF-target Delta Lake datasets.

field refresh_status: Optional[StrictStr] = None (alias 'RefreshStatus')

Last refresh status for materialized views. Redshift materialized views only. Omitted when status is N/A.

field last_refresh_completion_time: Optional[StrictStr] = None (alias 'LastRefreshCompletionTime')

ISO timestamp of last completed refresh. Redshift materialized views only. Omitted when value is N/A.

field s3_bucket_policy: Optional[Dict[str, Any]] = None (alias 'S3BucketPolicy')

S3 bucket policy for external datasets.

field kms_policy: Optional[Dict[str, Any]] = None (alias 'KmsPolicy')

KMS key policy for external datasets.

field data_permissions: Optional[List[RegisteredDatasetDataPermissionsInner]] = None (alias 'DataPermissions')

Lake Formation data filter permissions for the dataset. LF-target datasets not created via AWSConsole.

field data_profile: Optional[RegisteredDatasetDataProfile] = None (alias 'DataProfile')
field eda_status: Optional[StrictStr] = None (alias 'EdaStatus')

Status of structured EDA profiling (for example STARTING, IN_PROGRESS, COMPLETED, FAILED, STALE).

field eda_message: Optional[StrictStr] = None (alias 'EdaMessage')

Human-readable message for structured EDA profiling state.

field eda_staleness: Optional[StrictStr] = None (alias 'EdaStaleness')

Staleness indicator for structured EDA profiling results.

field eda_staleness_message: Optional[StrictStr] = None (alias 'EdaStalenessMessage')

Human-readable message for EDA profiling staleness.

field update_schema_status: Optional[StrictStr] = None (alias 'UpdateSchemaStatus')

Status of the latest dataset schema update. Set on the datasets table when a schema update is started or finished. Compared case-insensitively for in-progress (e.g. InProgress). Other values include success and failure messages (e.g. Failed, schema update process timed out).

to_str()

Returns the string representation of the model using alias

Return type:

str

to_json()

Returns the JSON representation of the model using alias

Return type:

str

classmethod from_json(json_str)

Create an instance of RegisteredDataset from a JSON string

Return type:

Optional[Self]

to_dict()

Return the dictionary representation of the model using alias.

This has the following differences from calling pydantic’s self.model_dump(by_alias=True):

  • None is only added to the output dict for nullable fields that were set at model initialization. Other fields with value None are ignored.

Return type:

Dict[str, Any]

classmethod from_dict(obj)

Create an instance of RegisteredDataset from a dict

Return type:

Optional[Self]