Azure / Azure/MachineLearningNotebooks
Cache dataset locally
- Linguagem predominante
- Jupyter Notebook
- Estrelas
- 4.4k
- Forks
- 2.6k
- Métricas de merge de PRs
- Nenhum PR com merge em 30d
Descrição
I write a score script to be used in a batch scoring pipeline. I can use `ds.to_pandas_dataframe()` to get a dataframe, and by a bit of parameterizing I can run the script both locally and in-the-cloud. But when I run it locally it downloads the dataset every time. It would be nice if it was possible (maybe default off) to cache the dataset locally for faster execution.
Guia de contribuição
Nenhum guia de contribuição indexado para este repositório
Direção de pesquisa
O payload não menciona nenhum arquivo ou teste. Comece rastreando a chamada ds.to_pandas_dataframe() do script de scoring e comparando a execução local com a execução na nuvem. Considera-se concluído quando as execuções locais puderem reutilizar um dataset em cache por meio de uma opção definida ou por padrão, enquanto o comportamento na nuvem continuar utilizável.
Escrita pelo modelo de indexação a partir do texto da issue.
Avaliação
- Stack de tecnologia
- jupyter-notebook, python
- Domínio
- cloud, data, machine-learning
- Tipo de issue
- Funcionalidade
- Dificuldade
- 4/5
- Tempo estimado
- 3-5 dias
- Status de atividade
- Estagnada
- Clareza
- Razoavelmente clara
- Facilidade para iniciantes
- 30/100