google-deepmind / google-deepmind/gemma
Preparing Biomedical Multimodal (Text+Images/Tables/Formulas) Dataset for Gemma Fine-tuning
- Dominant language
- Python
- Stars
- 5.7k
- Forks
- 1k
- Avg merge
- 10h 33m
- Merged PRs (30d)
- 2
Description
Hi,@gemma team
I’m working on a biomedical/medical domain fine-tuning dataset converted from PDFs to Markdown. The content contains:
• Images (medical diagrams, charts)
• Complex tables (clinical data)
• Mathematical formulas (drug dosage equations, statistical models)
Could the Gemma team advise:
1. Best practices for handling multimodal elements in Markdown format during dataset preparation?
2. Recommended preprocessing steps for preserving semantic relationships between text & non-text elements?
3. Any existing tutorials/documentation for similar technical/academic domain fine-tuning?
Any help would be greatly appreciated!
Yang
Contributor guide
Assessment
This issue has not been assessed yet.