mapstruct / mapstruct/mapstruct-examples
Convert Spark Dataframe to Dataset with MapStruct
Nadie ha tomado este issue todavía.
- Lenguaje dominante
- Java
- Estrellas
- 1.4k
- Forks
- 504
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Descripción
When using Apache Spark with Java there is a pretty common use case of converting Spark's Dataframes to POJO-based Datasets. The thing is that many times your Dataframe is imported from a database in which the column namings and types are different from your POJO.
Example for this can be found on the following Stackoverflow question (which has been solved programmatically with a map and rename functions). I was wondering if that example could be solved with MapStruct (and maybe would be added to this examples repo).
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Línea de trabajo
Comienza revisando el repositorio mapstruct-examples y la pregunta vinculada de Stack Overflow para comprender la conversión solicitada de Spark DataFrame a Dataset. Identifica dónde encajaría un ejemplo de Spark y Java y, a continuación, determina si MapStruct puede gestionar nombres de columnas de base de datos y tipos de campos de POJO diferentes. Se considerará completado cuando exista un ejemplo documentado y funcional que cubra esa conversión.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- java, spark
- Área
- data-engineering
- Tipo de issue
- Nueva funcionalidad
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Estado de actividad
- Estancado
- Claridad
- Bastante claro
- Aptitud para principiantes
- 25/100