google-deepmind / google-deepmind/gemma

Preparing Biomedical Multimodal (Text+Images/Tables/Formulas) Dataset for Gemma Fine-tuning

Open
#210 5 comments 0 reactions 0 assignees View on GitHub
Dominant language
Python
Stars
5.7k
Forks
1k
Avg merge
10h 33m
Merged PRs (30d)
2

Description

Hi,@gemma team

I’m working on a biomedical/medical domain fine-tuning dataset converted from PDFs to Markdown. The content contains:
• Images (medical diagrams, charts)
• Complex tables (clinical data)
• Mathematical formulas (drug dosage equations, statistical models)
Could the Gemma team advise:
1. Best practices for handling multimodal elements in Markdown format during dataset preparation?
2. Recommended preprocessing steps for preserving semantic relationships between text & non-text elements?
3. Any existing tutorials/documentation for similar technical/academic domain fine-tuning?

Any help would be greatly appreciated!
Yang

Contributor guide

Open the contributing guide

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.