dbiir / dbiir/UER-py

微调 finetune/run_classifier_siamese.py 模型不收敛。

Open
#330 3 comments 0 reactions 0 assignees View on GitHub
Dominant language
Python
Stars
3.1k
Forks
520
PR merge metrics
No merged PRs in 30d

Description

![image](https://user-images.githubusercontent.com/70731194/177521512-91a75186-415e-4f7f-80c4-af01ff5bd255.png)
预训练模型:https://huggingface.co/uer/chinese_roberta_L-12_H-768

训练命令:
python finetune/run_classifier_siamese.py --pretrained_model_path sbert_base/pytorch_model.bin --vocab_path models/google_zh_vocab.txt --config_path models/sbert/base_config.json --train_path datasets/ChineseTextualInference/train.tsv --dev_path datasets/ChineseTextualInference/dev.tsv --learning_rate 5e-5 --epochs_num 5 --batch_size 64

huggingface上, 有人在用这个代码训练文本相似度模型,效果挺好,但我按照相同方法,无法复现模型。huggingface地址:https://huggingface.co/uer/sbert-base-chinese-nli。
请赐教,不胜感激。!!!

Contributor guide

No contributing guide indexed for this repository

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.