Azure / Azure/MachineLearningNotebooks

Issue with SynapseSparkStep in an AML pipeline to orchestrate data prep step

Abierto
#1,639 0 comentarios 0 reacciones 0 asignados Ver en GitHub
Lenguaje dominante
Jupyter Notebook
Estrellas
4.4k
Forks
2.6k
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

https://github.com/Azure/MachineLearningNotebooks/blob/master/how-to-use-azureml/azure-synapse/spark_job_on_synapse_spark_pool.ipynb

I am following this document, and was able to run end to end a few weeks ago. However, it is suddenly not working when to save the output file to the HDFSOutputDatasetConfig file. My microsoft alias is klei@microsoft.com, can you please help ping me to resolve this issue?

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Línea de trabajo

Abre y vuelve a ejecutar azure-synapse/spark_job_on_synapse_spark_pool.ipynb, centrándote en SynapseSparkStep y su salida HDFSOutputDatasetConfig. Captura el fallo actual al guardar la salida y compáralo con el flujo end-to-end que funcionaba anteriormente; se considera terminado cuando el paso de preparación de datos se completa y el archivo de salida se guarda correctamente.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
azure, jupyter-notebook, python
Área
data-engineering, machine-learning
Tipo de issue
Error
Dificultad
4/5
Tiempo estimado
3-5 días
Estado de actividad
Estancado
Claridad
Necesita aclaración
Aptitud para principiantes
20/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.