4paradigm / 4paradigm/AutoX

Sample selection

Abierto
#17 0 comentarios 0 reacciones 0 asignados Ver en GitHub
Lenguaje dominante
Jupyter Notebook
Estrellas
551
Forks
143
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

I would like to ask if AutoX has any plans for sample selection?

Now many data sets are so large that the computing power of individuals and small companies cannot afford.

Can a part of the data be selected for training to approximate the effect of full data training?

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Línea de trabajo

Look at the AutoX codebase for data loading and preprocessing modules to understand the current pipeline. Investigate existing sampling techniques or if any are implemented. Determine how to integrate a sample selection feature that works with large datasets and evaluate its impact on training performance.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
jupyter-notebook, machine-learning, python
Área
data-engineering, machine-learning
Tipo de issue
Nueva funcionalidad
Dificultad
4/5
Tiempo estimado
3-5 días
Estado de actividad
Estancado
Claridad
Bastante claro
Aptitud para principiantes
35/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.