Azure / Azure/MachineLearningNotebooks

Issue with SynapseSparkStep in an AML pipeline to orchestrate data prep step

Aberta
#1,639 0 comentários 0 reações 0 responsáveis Ver no GitHub
Linguagem predominante
Jupyter Notebook
Estrelas
4.4k
Forks
2.6k
Métricas de merge de PRs
Nenhum PR com merge em 30d

Descrição

https://github.com/Azure/MachineLearningNotebooks/blob/master/how-to-use-azureml/azure-synapse/spark_job_on_synapse_spark_pool.ipynb

I am following this document, and was able to run end to end a few weeks ago. However, it is suddenly not working when to save the output file to the HDFSOutputDatasetConfig file. My microsoft alias is klei@microsoft.com, can you please help ping me to resolve this issue?

Guia de contribuição

Nenhum guia de contribuição indexado para este repositório

Direção de pesquisa

Abra e execute novamente azure-synapse/spark_job_on_synapse_spark_pool.ipynb, concentrando-se em SynapseSparkStep e em sua saída HDFSOutputDatasetConfig. Registre a falha atual ao salvar a saída e compare-a com o fluxo end-to-end que funcionava anteriormente; a tarefa estará concluída quando a etapa de preparação dos dados for concluída e o arquivo de saída for salvo com sucesso.

Escrita pelo modelo de indexação a partir do texto da issue.

Avaliação

Stack de tecnologia
azure, jupyter-notebook, python
Domínio
data-engineering, machine-learning
Tipo de issue
Bug
Dificuldade
4/5
Tempo estimado
3-5 dias
Status de atividade
Estagnada
Clareza
Precisa de esclarecimento
Facilidade para iniciantes
20/100

Receba novas issues na sua caixa de entrada

Um resumo curto de issues do GitHub para quem está começando.