codestates / codestates/ds-TIL
[TIL] day 72 오세광 201215
- Dominant language
- No language data
- Stars
- 2
- Forks
- 1
- PR merge metrics
- No merged PRs in 30d
Description
# 키워드: bow, dam ,tf-idf, n-gram, K-nn, skip-gram, word2vec
# (Act)What you actually did.
1. Bag of works 모델로 활용
2. Tf-idf
3. Knn
4. word2vec
# (Evaluate)How you evaluate your action's outcome vs. the initial goal(plan).
1. Bag of works는 단어의 빈도만 고려하는 모델, 문서를 토큰화 후 토큰의 빈도를 기반으로 벡터화
2. 어떤 단어가 중요한지 찾는것, 자주 등장하는 단어 중요도 높다고 판단(TF), 여러 문서에서 많은 등장하는 단어 중요도 낮다고 판단(IDF)
3. Knn K-최근접 이웃법, K개의 데이터의 유사성을 기반으로 추정하거나 분류하는 모델
4. Word2vec 단어 임베딩 방법은 문법정보를 보전, 인접한 단어들의 정보를 중요시하여 벡터화할 때 문맥 정보 보존
# (Reflect)
How you worked throughout the stages plan-research-act-observe-evaluate.
What did you do well, what can you improve upon.
How can you improve your process?
1. 자연어를 임베딩하는 모델들을 배웠다.
2. 개념적으로는 이해했고 ,이제 실제 코드를 구현하며 실행착오 겪을 예정이다.
오늘 n411a 하나씩 차근차근했다. 조금 늦지만 차근차근 이해되서 느리지만 재미있다.
Contributor guide
No contributing guide indexed for this repository
Assessment
This issue has not been assessed yet.