codestates / codestates/ds-TIL
[TIL]김지연 201028
- Dominant language
- No language data
- Stars
- 2
- Forks
- 1
- PR merge metrics
- No merged PRs in 30d
Description
:warning: 해당 템플릿은 기본 예시입니다. 수강생 여러분의 방식에 맞춰 **자유롭게** 작성해주시길 바랍니다 :warning:
:no_entry_sign: **과제 솔루션 공유 절대 금지** :no_entry_sign:
- **키워드**: `배운 내용에 해당하는 키워드를 2-3개 정도 적습니다 (예: Python, pandas, 시각화, etc.)`
--> 특성 중요도 계산, Adaboost
- **배운 것**: `어떤 내용을 배웠는지 간략하게 적습니다`
-->
특성중요도
1. feature importances : 평균 불순도 감소를 계산해서 보여줌
2. drop-column importance : 컬럼을 하나씩 제거해보는 것으로 가장 쉽고 직관적이지만 시간이 오래 걸린다.
3. **permutation importance** : 모델을 만든 뒤 validation 셋에 적용하는 것, 특성의 값을 랜덤으로 섞어 특성을 무력화
Adaboost
1.랜덤포레스트와 다르게 현재 트리가 다음 트리에 영향을 준다.
2. 관측치에도 가중치(관측치가 잘못 분류된 경우 관측치에 더 높은 가중치)를 주고 트리에도 또 다른 가중치(트리에 에러가 많을수록 가중치 감소)를 준다.
- **어려웠던 부분**: `배운 내용 중에서 어렵거나 헷갈렸었던 부분을 작성합니다`
--> 데이터프레임에 apply, lambda, list comprehension을 써봤는데 아직 미숙해서 더 써봐야할 것 같다.
- **더 알고 싶은 부분 / 공부하고 싶은 부분**: `더 알고 싶거나 공부할 필요가 있는 부분에 대해 작성합니다`
--> gradient boost 아직 개념이 와닿지 않아서 영상을 더 봐봐야할 것 같다.
- **느낀 점**: `오늘 하루에 대한 감상, 기분 등을 간단하게 작성합니다`
--> 오늘은 코딩을 하면서 이것저것 시도해봐서 재밌었다. 하지만 여전히 데이터 랭글링은 어렵다.
Contributor guide
No contributing guide indexed for this repository
Assessment
This issue has not been assessed yet.