Azure / Azure/MachineLearningNotebooks

Cache dataset locally

Aberta
#1,357 2 comentários 0 reações 0 responsáveis Ver no GitHub
ADO Data4ML product-issue
Linguagem predominante
Jupyter Notebook
Estrelas
4.4k
Forks
2.6k
Métricas de merge de PRs
Nenhum PR com merge em 30d

Descrição

I write a score script to be used in a batch scoring pipeline. I can use `ds.to_pandas_dataframe()` to get a dataframe, and by a bit of parameterizing I can run the script both locally and in-the-cloud. But when I run it locally it downloads the dataset every time. It would be nice if it was possible (maybe default off) to cache the dataset locally for faster execution.

Guia de contribuição

Nenhum guia de contribuição indexado para este repositório

Direção de pesquisa

O payload não menciona nenhum arquivo ou teste. Comece rastreando a chamada ds.to_pandas_dataframe() do script de scoring e comparando a execução local com a execução na nuvem. Considera-se concluído quando as execuções locais puderem reutilizar um dataset em cache por meio de uma opção definida ou por padrão, enquanto o comportamento na nuvem continuar utilizável.

Escrita pelo modelo de indexação a partir do texto da issue.

Avaliação

Stack de tecnologia
jupyter-notebook, python
Domínio
cloud, data, machine-learning
Tipo de issue
Funcionalidade
Dificuldade
4/5
Tempo estimado
3-5 dias
Status de atividade
Estagnada
Clareza
Razoavelmente clara
Facilidade para iniciantes
30/100

Receba novas issues na sua caixa de entrada

Um resumo curto de issues do GitHub para quem está começando.